{"as_of":"2026-08-18T23:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:641beee5ca7686f44072c0ed3aa22b28def13fb7853d36ecd785774f6e207ac8","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:55:34.085474Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.04556/citation-record","integrity":"/paper/2508.04556/integrity","json":"/paper/2508.04556/citation-record.json","paper":"/paper/2508.04556"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1801.01401","last_updated":"2021-01-14T05:36:59Z","snapshot_observed_at":"2026-08-13T06:40:48.610500Z","submitted_at":"2018-01-04T15:25:26Z","title":"Demystifying MMD GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01401","snapshot_observed_at":"2026-08-05T23:55:33.930982Z","title":"Demystifying mmd gans.arXiv preprint arXiv:1801.01401, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.930982Z"},"links":{"cited_paper":"/paper/1801.01401","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:0f536f23f8f8c69fa6401f2fd28e9f7d2cf7860b83713afe96a072c8fef2bd39","observation_id":"20e10ae6-f9f5-48b3-9561-3a6d081fbc49","resolution":{"observed_at":"2026-08-05T23:55:33.930982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.600780Z","title":"Robust treatment of collisions, contact and friction for cloth anima- tion","venue":null,"work_id":"20681dea-2284-40f7-a1c3-fa104db1aec3","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.935066Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:2265f5e7c0f7b6fbb1b1c06b0037700fc979e45e3afc8dffa302df8dd20a3370","observation_id":"95012925-a4f8-46ac-a472-9518fdab149a","resolution":{"observed_at":"2026-08-05T23:55:34.604091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.590812Z","title":"Anydoor: Zero-shot object-level im- age customization","venue":null,"work_id":"a8b34523-e0f1-489e-a812-fdc3602df17d","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.938379Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:2ff226a15d4be4e0352c123940086432661c1be70c17eaa825be9c952b5990b8","observation_id":"d393d671-bb34-4648-a964-bc1b0dad7f70","resolution":{"observed_at":"2026-08-05T23:55:34.594330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.581127Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"daf18dac-ed9c-4eb9-ac5a-f377c31294bd","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.941596Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:eca154cc7b48322da796bebd07694bac55b0b71e082525960aa6bf76211ced4f","observation_id":"35db57e2-d041-4da9-b86f-49f31bb33b3d","resolution":{"observed_at":"2026-08-05T23:55:34.584422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05139","last_updated":"2024-07-29T09:15:33Z","snapshot_observed_at":"2026-08-18T23:34:22.343473Z","submitted_at":"2024-03-08T08:12:18Z","title":"Improving Diffusion Models for Authentic Virtual Try-on in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05139","snapshot_observed_at":"2026-08-05T23:55:33.944896Z","title":"Improving diffusion models for vir- tual try-on.arXiv preprint arXiv:2403.05139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.944896Z"},"links":{"cited_paper":"/paper/2403.05139","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:1b0f9be10a3f9b5bfad2173f2860797d650f9615e6b3c20135428f746bf556a0","observation_id":"41960fed-eef4-4ff8-a89a-802db33a6b44","resolution":{"observed_at":"2026-08-05T23:55:33.944896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15886","last_updated":"2025-02-16T03:41:41Z","snapshot_observed_at":"2026-08-16T13:32:23.242134Z","submitted_at":"2024-07-21T11:58:53Z","title":"CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15886","snapshot_observed_at":"2026-08-05T23:55:33.948223Z","title":"Catvton: Concatenation is all you need for virtual try- on with diffusion models.arXiv preprint arXiv:2407.15886,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.948223Z"},"links":{"cited_paper":"/paper/2407.15886","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:896d7741a5a0f8b80333adec4f879ab50c7d30781fd5d99e6fc47e70d542264d","observation_id":"40085c33-bc1f-4916-86a1-05a9e5f3b5a3","resolution":{"observed_at":"2026-08-05T23:55:33.948223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.571559Z","title":"Street tryon: Learning in-the-wild virtual try-on from unpaired person images","venue":null,"work_id":"3c6e1738-3fcd-418d-924a-3313c3c85f2e","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.951670Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:fb2cffc561217020cfc2769f7c47434a0cb45f56c9a8ac4952f26173b84be8b5","observation_id":"19d9d965-168a-40f7-b810-308d61e829d2","resolution":{"observed_at":"2026-08-05T23:55:34.574754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:33.954795Z","title":"Image quality assessment: Unifying structure and texture similarity.IEEE transactions on pattern analysis and ma- chine intelligence, 44(5):2567–2581, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.954795Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:81bdf55e94520570ad4ebe21e3984bb68aaf6c46facb7bc7888530018257af50","observation_id":"431eb11c-8c6e-4ad2-8599-e4ed783ce6b6","resolution":{"observed_at":"2026-08-05T23:55:33.954795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.555740Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"e0fd345e-2d0d-4c45-91c8-5d4055c947bf","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.957939Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:a25f0033b30dd3dae86da93bccda5618aba9baeb706edf5dbaf0f73d718b423d","observation_id":"9b8fb793-b216-4d94-adaa-b14f09a8a255","resolution":{"observed_at":"2026-08-05T23:55:34.558877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.546152Z","title":"Humans in 4d: Re- constructing and tracking humans with transformers","venue":null,"work_id":"73f0aa13-0058-4c0d-91e2-d4d72b292c94","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.960825Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:fd09e558e1107f2b200426fb8e809abc6cf983d729890e0ef42e119acf1a8187","observation_id":"37c692f9-4093-498d-ab39-7239269e0586","resolution":{"observed_at":"2026-08-05T23:55:34.549375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.535867Z","title":"Taming the power of diffusion models for high-quality virtual try-on with appearance flow","venue":null,"work_id":"d081cf60-018a-42d1-9e95-e4d368a351e7","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.964096Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:16110cd6817ef332fa79131fa5d4efe2a1aef55a79c7e46e24e8fb75ddd3e912","observation_id":"1a873293-8a95-4402-bb1d-5f5b6c38acd6","resolution":{"observed_at":"2026-08-05T23:55:34.539062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.526684Z","title":"Any2anytryon: Leveraging adaptive position embeddings for versatile virtual clothing tasks","venue":null,"work_id":"aa14833d-2b91-4d3c-89b4-c845d57e1fc7","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.967003Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:38bdd1b5b2ce4dddb32d5d1f5190da11678a82ef0bdd515262c984e0f4f14af2","observation_id":"6ca80180-fa07-4d4d-b991-4d8e707f2f1e","resolution":{"observed_at":"2026-08-05T23:55:34.529802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:33.970295Z","title":"Wildvidfit: Video virtual try- on in the wild via image-based controlled diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.970295Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:817b5ff8aaf71bed39b52405eecf8729fdce04238f9a4192efdb503c2a3ff4bf","observation_id":"9a0a4712-ff44-4a60-b907-8be6ebf5ae13","resolution":{"observed_at":"2026-08-05T23:55:33.970295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.511677Z","title":"Vton 360: High-fidelity virtual try-on from any viewing direction","venue":null,"work_id":"ab6898c0-1021-4126-857e-4aa8d7c33a6c","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.973022Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:618a88a1f49524c06fd5e023163a03c855a3b54302905dab368ce7516bcd7eae","observation_id":"fa17e449-54f2-4325-a7b5-853faffeaaf1","resolution":{"observed_at":"2026-08-05T23:55:34.514604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.502980Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"d4ae67b3-ab2c-40cc-b91f-0050ab6d94ef","year":2017},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.975928Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:f14685722f5ec581f6406e54ce2fa32e4f7705e29de2a81f7258602a92ded14a","observation_id":"21c99c61-b0e2-48f4-9041-585e71893676","resolution":{"observed_at":"2026-08-05T23:55:34.506151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T23:55:33.978697Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.978697Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:00b4d9d964df1b4b17fd4ebddf82e3299b86e5fc4b51bd7d1277603e8a0edfc2","observation_id":"bdac8ce7-a7c8-4d5b-b9d1-bf1e4e81f378","resolution":{"observed_at":"2026-08-05T23:55:33.978697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.493624Z","title":"From parts to whole: A unified reference framework for con- trollable human image generation, 2024","venue":null,"work_id":"d3cfe45c-6e1a-446b-ab4c-b8b71168748f","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.981830Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:6b8d5040af7ac1a2a6d479c97c168b165ec37d1c64e4caa34a08f6b88dc6c40f","observation_id":"c019f15a-a952-4d99-8a9c-e2a82ff81861","resolution":{"observed_at":"2026-08-05T23:55:34.496807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.484207Z","title":"Do not mask what you do not need to mask: a parser-free virtual try-on","venue":null,"work_id":"3623fd94-c74d-4c99-972b-0f5ab31520ea","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.984584Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:5da474b3d65c20447eced56bf9a52dbdad0bc607e927462aa6f23985c008453c","observation_id":"6719214a-7baf-4630-8810-6d307f7b13fc","resolution":{"observed_at":"2026-08-05T23:55:34.487382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10499","last_updated":"2024-11-22T08:19:48Z","snapshot_observed_at":"2026-08-17T04:43:59.382444Z","submitted_at":"2024-11-15T11:02:23Z","title":"FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10499","snapshot_observed_at":"2026-08-05T23:55:33.987841Z","title":"Fitdit: Advancing the authentic garment details for high-fidelity virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.987841Z"},"links":{"cited_paper":"/paper/2411.10499","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:657f53798de6ce4b294ed90775c1617efcc6a948d3ecb5168f8559c092a7bfe1","observation_id":"ab6a4b08-9aeb-4593-b134-7b3f6dc5c395","resolution":{"observed_at":"2026-08-05T23:55:33.987841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.474687Z","title":"Text2human: Text-driven controllable human image generation.ACM Transactions on Graphics (TOG), 41(4):1–11, 2022","venue":null,"work_id":"8c3085a9-c1aa-4218-beac-878a80ab8fe7","year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.990839Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:7091eee9adf58e383146a0529a80a2820bb1c2b6f6792f298e156f84b7f86bbe","observation_id":"486ffa62-53f0-4923-9082-40b85bf212e2","resolution":{"observed_at":"2026-08-05T23:55:34.477929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.464084Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":"e44b31aa-6a8a-4d36-a210-71c4598296c7","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.993585Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d089fe1a8cbfd9ed9cadb7f460836e2d862788ab8e5283489c1060cb03547fbb","observation_id":"6cef25d6-0192-48aa-a90c-7c04cfb82b47","resolution":{"observed_at":"2026-08-05T23:55:34.467690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.454444Z","title":"High-resolution virtual try-on with misalignment and occlusion-handled conditions","venue":null,"work_id":"b251ac52-3cbc-410f-beea-c7bb2356063d","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.996261Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:c4b5a57558df23403f6cc7eb4c0f6da2b118ba62714f15990f6e8a388d0f1ea3","observation_id":"313de8c7-44c5-42e2-9799-da649c6ebb16","resolution":{"observed_at":"2026-08-05T23:55:34.457675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.444681Z","title":"Self- correction for human parsing.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2020","venue":null,"work_id":"0daa5f12-db11-4b1d-9fa8-b6543707705a","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:33.998939Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9aa0ff2046d410322c9cb9e1d673cd034c3cbf883f7cd575007b7832ea2fcfda","observation_id":"b0f17fb1-5219-43ee-937b-b3bed45d8e89","resolution":{"observed_at":"2026-08-05T23:55:34.447946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.435238Z","title":"In-situ tweedie discrete diffusion models, 2025","venue":null,"work_id":"cc632c20-8f3d-4fda-bd0f-65d84fc6d08b","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.001570Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:4a71d2a459f5557776149ccbf15434450f144c19343d4b251394d04aae6383b6","observation_id":"9ad21b11-c484-4e0b-b591-7a490870942b","resolution":{"observed_at":"2026-08-05T23:55:34.438383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.425758Z","title":"Deepfashion: Powering robust clothes recog- nition and retrieval with rich annotations","venue":null,"work_id":"78f4c519-72de-42fa-af58-64e7cf674f1d","year":2016},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.004410Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:509fcd749efffd7c9ab78862f8e0835ac5084fb6bd849e4583d1582ac839bd52","observation_id":"dbd02cb5-a89f-4116-bbdf-b61a9f6e1d20","resolution":{"observed_at":"2026-08-05T23:55:34.428929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T23:55:34.007006Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.007006Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:c971bea4f676d0df1de35610ce30a89f30db60a0c225dd0d560785d2c1ce7e8c","observation_id":"2ab891f1-a1f1-40e1-8bdc-83182f054a45","resolution":{"observed_at":"2026-08-05T23:55:34.007006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.416090Z","title":"Ladi-vton: Latent diffusion textual-inversion enhanced virtual try-on","venue":null,"work_id":"e6a688ac-0424-4f0d-89ef-3261128ee710","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.010021Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:8976ea6267b51dc23518b112bd4cb34e5fe1c85d6dad25e61b75473226bb74d3","observation_id":"f383e4b5-be71-44cc-a1aa-f00e76cd7657","resolution":{"observed_at":"2026-08-05T23:55:34.419635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T23:55:34.012820Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.012820Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:8f60c37e535b357d77fb220c3db66757ce2fa275d64bba7f0aafc4afcebfbd64","observation_id":"3e606eae-5ae9-423b-bef5-6d6433e0d2be","resolution":{"observed_at":"2026-08-05T23:55:34.012820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T23:55:34.015859Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.015859Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9641338c8d55764bd5a800899c700f5fdff3695f8022f844001aee57b8eaf064","observation_id":"440973cd-5371-4b34-a613-a2edb7175130","resolution":{"observed_at":"2026-08-05T23:55:34.015859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.406291Z","title":"Expressive body capture: 3d hands, face, and body from a single image","venue":null,"work_id":"0f2b86e2-0084-4b3e-a3c7-3249ad67dcc2","year":2019},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.018747Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:d48f6d2ea4d86c1888bec9a5b7a61ad6320bc8ac3e9733908ff12d697a8914f4","observation_id":"98044ae7-5b13-4abf-a55a-fa3b885f613d","resolution":{"observed_at":"2026-08-05T23:55:34.409511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.021491Z","title":"Clothcap: Seamless 4d clothing capture and retar- geting.ACM Transactions on Graphics (ToG), 36(4):1–15,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.021491Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:8363cba41390d1f9279afe802c85bdf92b424bbcbee6466b3e280d75efd14aca","observation_id":"52eebffc-ed70-41ae-9dd4-8df374ef8c72","resolution":{"observed_at":"2026-08-05T23:55:34.021491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.390589Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"e417a089-1c35-4ce2-bd17-79dc439684ab","year":2021},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.024233Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:4de193b3bc3c91b043237ea22b9395dcd5c1693b29beff5e9d0b3f2b06e90d81","observation_id":"200a3bde-919d-4b49-b975-e9cfe06a78a6","resolution":{"observed_at":"2026-08-05T23:55:34.393922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.026916Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.026916Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:ee014cfe1fa2e06204b577a61c893f054b32371a929bd3c843f27a7507f9c1e2","observation_id":"49426383-b39e-4a2d-b08e-233b7a8950fb","resolution":{"observed_at":"2026-08-05T23:55:34.026916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.373593Z","title":"Simple and effective masked dif- fusion language models.Advances in Neural Information Processing Systems, 37:130136–130184, 2024","venue":null,"work_id":"42e7997d-3dba-4f68-8235-c5c24658e4da","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.029575Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:99cdddf0a758276b3e45d1faf0651ea243caa57439a400c78a1725a715df48fd","observation_id":"33efb427-89a9-4ac4-9e36-8fa1c3fe1488","resolution":{"observed_at":"2026-08-05T23:55:34.377104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T23:55:34.032490Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.032490Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:7c86c2a8c7554fe7ef7b699befc7b5cdd1102e68b3f5a338e1d52f52d995fe51","observation_id":"0d74f97a-0a01-4aed-9c0e-fdc6f6fa7db4","resolution":{"observed_at":"2026-08-05T23:55:34.032490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.363445Z","title":"Tryoffdiff: Virtual-try-off via high-fidelity gar- ment reconstruction using diffusion models, 2024","venue":null,"work_id":"d70960fe-2baa-43e0-8c55-90e35523ed5b","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.035516Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:191ddaf7cbfa17c3a5e3cc07e85cd8fcb85cb632587ac7ade80f661ccd88a7cd","observation_id":"b108edf5-1075-4a3e-9ab2-509b403c19c9","resolution":{"observed_at":"2026-08-05T23:55:34.366620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.038248Z","title":"A connection between score matching and denoising autoencoders.Neural computation, 23(7):1661– 1674, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.038248Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:3ef32315fc400d7db9536b77e2e41c737f34e32a9dbd323ff9f06a4016686b43","observation_id":"34a6008b-1eff-4f25-9eb2-e1d2bde609e4","resolution":{"observed_at":"2026-08-05T23:55:34.038248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.346444Z","title":"Toward characteristic- preserving image-based virtual try-on network","venue":null,"work_id":"76633ac1-7bc6-49b5-bb5d-5acbb70ed178","year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.040866Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:a611cd0fdb0f3ac3067473ad31ffe29bd9ab24f9a9774a87cad556308ecd378c","observation_id":"0167e9c2-2f45-4fe3-a4f2-70795fb47a9d","resolution":{"observed_at":"2026-08-05T23:55:34.350280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.337124Z","title":"Mv-vton: Multi-view virtual try-on with diffusion models","venue":null,"work_id":"54a5d570-395a-492c-a0d4-0c44bcf490f4","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.043602Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:83670ae22752cedd7f70ea57d8ca55b139508b4622c6ef2fc6b62fcdf7671a3f","observation_id":"be6bd1f6-81ae-4f78-8e2f-d62a4fe058d4","resolution":{"observed_at":"2026-08-05T23:55:34.340242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10783","last_updated":"2024-03-16T03:05:07Z","snapshot_observed_at":"2026-08-16T19:20:17.535142Z","submitted_at":"2024-03-16T03:05:07Z","title":"StableGarment: Garment-Centric Generation via Stable Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10783","snapshot_observed_at":"2026-08-05T23:55:34.046194Z","title":"Stablegar- ment: Garment-centric generation via stable diffusion.arXiv preprint arXiv:2403.10783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.046194Z"},"links":{"cited_paper":"/paper/2403.10783","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:da0eb79fda68549016dbf420d7368e8172f2539bcfcdec8a2ac49479b278ef9d","observation_id":"d05a4d99-f095-4683-b2e4-1568af09cf5a","resolution":{"observed_at":"2026-08-05T23:55:34.046194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.327087Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":"2405f8ed-21cc-4c8e-b9ce-fdb7e3e3320f","year":2004},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.049158Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:2d6d00ddf0556335e8c48d62a70a7790960d510f5f4f1e9142859fe7b95dfebd","observation_id":"00909a2b-922c-48d5-ac90-138c4c32d842","resolution":{"observed_at":"2026-08-05T23:55:34.330777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.317333Z","title":"Tryoffany- one: Tiled cloth generation from a dressed person, 2025","venue":null,"work_id":"083fa7f0-3c5c-478b-a4b0-2d96794f1443","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.052034Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:bff61d12ef7aedee5c02c348652f19665d80ca1d01e28a64e675ca60e188c891","observation_id":"7ab19d63-4dac-4d02-923e-988cc154a4c3","resolution":{"observed_at":"2026-08-05T23:55:34.320572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.306861Z","title":"Gp- vton: Towards general purpose virtual try-on via collabora- tive local-flow global-parsing learning","venue":null,"work_id":"3f8c9c18-3a9b-4a4c-a7c6-0de51328a8c1","year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.054877Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:68161cdc3437cc73c743df6f861be97042b700dc5f440cd5b223499255466751","observation_id":"89651f96-fdda-45dd-91ff-32c2ab6b67f4","resolution":{"observed_at":"2026-08-05T23:55:34.310291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.297080Z","title":"Dreamvton: Customizing 3d virtual try-on with personalized diffusion models","venue":null,"work_id":"2e26ea7f-a32a-4a44-b3c8-77ec7a6b6cb5","year":2024},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.057357Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:e107076213f2d85e9ea89ed72b7d605b82b8ca3fb3ca526041212049715bbb67","observation_id":"3f4c3c40-3a99-4ca4-af9f-9b0b47a1e56a","resolution":{"observed_at":"2026-08-05T23:55:34.300445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.287151Z","title":"Ootd- iffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on","venue":null,"work_id":"3603470f-8519-447c-be67-bff798837595","year":2025},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.059985Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:8ac0ada8dd92585ff2b1e1c127745efceedd5ea9fd1c84ead676297d32a80972","observation_id":"0d180ae1-6cdd-4b21-ac64-2ddeb606857d","resolution":{"observed_at":"2026-08-05T23:55:34.290496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.277194Z","title":"Bridging the discrete-continuous gap: Unified multimodal generation via coupled manifold discrete absorbing diffu- sion, 2026","venue":null,"work_id":"89157f61-28da-464f-a77a-5def0b1f12af","year":2026},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.062514Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:42e004e8ff3de6185ce79abc843c393f52aacde9bcafddc20e6282806d3d7e22","observation_id":"a40d58a8-9c2f-4922-9195-6b8eabcfadbe","resolution":{"observed_at":"2026-08-05T23:55:34.280527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.267037Z","title":"Towards photo-realistic virtual try-on by adaptively generating-preserving image content","venue":null,"work_id":"ec46fa64-a86a-4d30-8d60-85d944dde409","year":2020},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.065227Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:93dc365c5a79e980a4b873f8a7fd2352f4715ff8de042e0ea6242e4f095242a2","observation_id":"7f3f375b-1341-41b1-a526-472ef8c0685a","resolution":{"observed_at":"2026-08-05T23:55:34.270698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T23:55:34.067836Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models.arXiv preprint arXiv:2308.06721,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.067836Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:98c5d50f68a2b13b630365239d383d3f71da4d509ff8114ab02f5601b23baffd","observation_id":"9a9ed70d-d25b-4482-9c59-1dd5229d387f","resolution":{"observed_at":"2026-08-05T23:55:34.067836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.256685Z","title":"E0: Enhancing generalization and fine-grained con- trol in vla models via tweedie discrete diffusion, 2026","venue":null,"work_id":"a23ef0b4-9992-48f0-8edb-fb1ceb6c58db","year":2026},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.071257Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:b2499d20ad43fecb19901e37f9522777a650f6fc7ecc06418e115da0bc0680fc","observation_id":"d632b8c0-a60d-4a5a-b1de-ffc0d44c7d83","resolution":{"observed_at":"2026-08-05T23:55:34.260152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.074070Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.074070Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:a0f74c2d986f1cf3ce40760427b95b64270f1cb7387d760e75c340dc8ed96225","observation_id":"a0e9b4ca-2feb-41aa-b6a4-7fc03c1bb49f","resolution":{"observed_at":"2026-08-05T23:55:34.074070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.076956Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.076956Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:66440f6c5153decf7d203645175717f03fde6aaab6e665f9d3f1decfbd53af2b","observation_id":"314813b1-e0d0-41e4-9413-e190758f0023","resolution":{"observed_at":"2026-08-05T23:55:34.076956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.079685Z","title":"Tryondiffusion: A tale of two unets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.079685Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:ea6ccdd8099648d7857893a02b392b18e5fbc61d0b0b98ce93a6fc7854b5cfc9","observation_id":"4a970445-a481-4980-b019-d59d72cbc25e","resolution":{"observed_at":"2026-08-05T23:55:34.079685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.227755Z","title":"Virtual Try-on Person-to-person Virtual Try-on.Fig","venue":null,"work_id":"26ef6554-9c47-4622-8aaf-eb7c31656a84","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.082404Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:9cfd05e35645ee0ee77ebb39defe58bb5fde523bda531955640b5dc733678b81","observation_id":"f180cb4e-0804-43b3-a60b-141da933a4da","resolution":{"observed_at":"2026-08-05T23:55:34.231244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:55:34.216136Z","title":"Furthermore, our architecture is only intended for a single garment input, whereas multiple garment inputs may dramatically extend the input sequence","venue":null,"work_id":"a74d2645-c5e1-421e-b506-5dc7d3cb6c55","year":null},"citing_paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:55:34.085474Z"},"links":{"citing_paper":"/paper/2508.04556"},"observation_digest":"sha256:5040f52e2411155c055d74c58c4955645d1b92ceb7e53f19c2888743ed500806","observation_id":"1f40d4b7-474f-4630-996a-03a4d80af528","resolution":{"observed_at":"2026-08-05T23:55:34.220891Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04556","last_updated":"2025-08-06T15:40:52Z","latest_version":1,"primary_category":"cs.NI","snapshot_observed_at":"2026-08-18T00:54:21.729120Z","submitted_at":"2025-08-06T15:40:52Z","title":"CONVERGE: A Multi-Agent Vision-Radio Architecture for xApps"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2508.04556."}