{"as_of":"2026-08-10T00:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6826a9f548bc0ec810a5ca3b8d89277bc4fe1f8f2d4b0e1349a79beab7dd0e84","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:10.389722Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05745/citation-record","integrity":"/paper/2608.05745/integrity","json":"/paper/2608.05745/citation-record.json","paper":"/paper/2608.05745"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.312937Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence (AAAI) , volume =","venue":null,"work_id":"8bcf2923-0efc-4892-a6d9-01dcf739538e","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.160929Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f3d3f19abe1caeb85d17a3705b9fd3c025a427d27668090f3759083fc608c4da","observation_id":"2027197f-6796-4712-8942-52dd68b735f8","resolution":{"observed_at":"2026-08-08T00:18:11.316555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.302608Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"9eda5564-62fe-464d-9523-2c6cc717e68f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.165360Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a35735fa60fbf2ef15d76f02bd9133fcac013760495363d73450366db0756c3c","observation_id":"040dd07d-56af-4bfa-9e2c-f47e6b6ae1f4","resolution":{"observed_at":"2026-08-08T00:18:11.306271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.292239Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":"cb8d97c6-5875-4f5c-b4ce-c3c77b27c0b3","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.169001Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:e5dc1bea6664bdedbb02e8e4830b799cf3dbfc208cdefc50cd5fd4a1a155d45f","observation_id":"44b58340-a81c-4454-b0fc-99ac300f941c","resolution":{"observed_at":"2026-08-08T00:18:11.296175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10499","last_updated":"2024-11-22T08:19:48Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T11:02:23Z","title":"FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10499","snapshot_observed_at":"2026-08-08T00:18:10.173095Z","title":"arXiv preprint arXiv:2411.10499 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.173095Z"},"links":{"cited_paper":"/paper/2411.10499","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:cf9f692587655d5df77f07fb58b7051934a1f590f5c63d891332c645f3239b5f","observation_id":"57465ee2-ba70-49a7-bcfb-754e3b7d5642","resolution":{"observed_at":"2026-08-08T00:18:10.173095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.282059Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"925f2dcb-36f7-4c05-85ee-f5eb59aed473","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.177206Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:68cdfe6543e30cc96bf50f12f02ebded9568dcb70463945c6674a5007653c4bd","observation_id":"b953dee0-3d80-41ab-8697-a17826db0852","resolution":{"observed_at":"2026-08-08T00:18:11.285728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.270732Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":"4cf08025-33d7-44e2-a542-6ff849829b95","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.180743Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a0b2112aba1bca0fd2937cd916572ffd3a25db210be68ad1e87ded2a357e4703","observation_id":"006be667-ebcd-4b6e-9c27-828d38ac76fc","resolution":{"observed_at":"2026-08-08T00:18:11.275213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.260520Z","title":"IEEE Transactions on Multimedia , volume =","venue":null,"work_id":"6c664485-abc2-49bb-b3e8-a15291b7b6d2","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.184259Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:52bfb3333f2645b55eff77878ede2b225b6f4592d49c529bb362cad629eb49b8","observation_id":"261161d4-2df3-4bba-a012-2fc8bcf14ead","resolution":{"observed_at":"2026-08-08T00:18:11.263999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18350","last_updated":"2025-08-07T19:11:41Z","snapshot_observed_at":"2026-07-06T19:57:55.925634Z","submitted_at":"2024-11-27T13:53:09Z","title":"TryOffDiff: Virtual-Try-Off via High-Fidelity Garment Reconstruction using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18350","snapshot_observed_at":"2026-08-08T00:18:10.187670Z","title":"arXiv preprint arXiv:2411.18350 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.187670Z"},"links":{"cited_paper":"/paper/2411.18350","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:80adfe0e467b584cc5d9ea4fc3de6d889e21088b13d03056bfa9e8097604f70f","observation_id":"d3cf88f5-0ab9-4b4f-964a-49902ad452b9","resolution":{"observed_at":"2026-08-08T00:18:10.187670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-06T22:25:50.554459Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21270","snapshot_observed_at":"2026-08-08T00:18:10.191565Z","title":"arXiv preprint arXiv:2506.21270 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.191565Z"},"links":{"cited_paper":"/paper/2506.21270","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:bd08a51e4a5a94c69a1630fb77c6b5a34164b675d2a58755a5045f190bfef02f","observation_id":"8aead11d-6794-4867-a0bb-00d0bfe66a75","resolution":{"observed_at":"2026-08-08T00:18:10.191565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11325","last_updated":"2025-01-20T08:09:36Z","snapshot_observed_at":"2026-08-08T02:53:10.035832Z","submitted_at":"2025-01-20T08:09:36Z","title":"CatV2TON: Taming Diffusion Transformers for Vision-Based Virtual Try-On with Temporal Concatenation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11325","snapshot_observed_at":"2026-08-08T00:18:10.195371Z","title":"arXiv preprint arXiv:2501.11325 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.195371Z"},"links":{"cited_paper":"/paper/2501.11325","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ed97a5d9dd281295662bed4187973d6926453ee0132e6d844b28517e02de93b0","observation_id":"5e46ed22-d538-4b1c-8a72-b8cbaec1f2b9","resolution":{"observed_at":"2026-08-08T00:18:10.195371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02807","last_updated":"2025-08-04T18:27:55Z","snapshot_observed_at":"2026-08-09T19:18:13.346448Z","submitted_at":"2025-08-04T18:27:55Z","title":"DreamVVT: Mastering Realistic Video Virtual Try-On in the Wild via a Stage-Wise Diffusion Transformer Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02807","snapshot_observed_at":"2026-08-08T00:18:10.199289Z","title":"arXiv preprint arXiv:2508.02807 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.199289Z"},"links":{"cited_paper":"/paper/2508.02807","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4a4becdfa3ce6f83208074b7ddd488679cf62c4d03fed5bff634ccf50b34825b","observation_id":"d814b52c-67a9-4937-9736-8ef6667486ac","resolution":{"observed_at":"2026-08-08T00:18:10.199289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09822","last_updated":"2025-07-28T07:49:34Z","snapshot_observed_at":"2026-08-01T21:24:54.954854Z","submitted_at":"2024-12-13T03:20:53Z","title":"Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09822","snapshot_observed_at":"2026-08-08T00:18:10.203291Z","title":"arXiv preprint arXiv:2412.09822 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.203291Z"},"links":{"cited_paper":"/paper/2412.09822","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b2bb5eeee0e68ba5c8f0f29cc41a72a6a471f3a6ff44f120ed3294c2ce6cb616","observation_id":"8486bbaa-fbd8-489c-9614-c8e3bd1fbe07","resolution":{"observed_at":"2026-08-08T00:18:10.203291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.207074Z","title":"arXiv preprint arXiv:2505.21325 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.207074Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8435e036f8611c8816e7e9db18b2c8b55859582421fe701dd90e3647d6f25b81","observation_id":"410474b1-edf0-4e06-a8ce-002a5491e87c","resolution":{"observed_at":"2026-08-08T00:18:10.207074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07654","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.729538Z","title":"arXiv preprint arXiv:2510.07654 , year =","venue":null,"work_id":"472fabe7-24a6-411a-834b-245964e4ecff","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.210634Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4194e8f845e4a17c33f13b3405c9ceffe4cc6304a81c4f131a08773813c68822","observation_id":"fc868d2c-fa0d-4001-b9da-4956ec352d3c","resolution":{"observed_at":"2026-08-08T00:18:10.735035Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11794","last_updated":"2024-05-28T04:08:09Z","snapshot_observed_at":"2026-07-06T18:16:33.179338Z","submitted_at":"2024-05-20T05:28:22Z","title":"ViViD: Video Virtual Try-on using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11794","snapshot_observed_at":"2026-08-08T00:18:10.214093Z","title":"arXiv preprint arXiv:2405.11794 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.214093Z"},"links":{"cited_paper":"/paper/2405.11794","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:44e519a92d4dfc9c3ccc618daf522cf7696b70a641a858a51375ed6b0996bc9a","observation_id":"96ae3c7a-8b11-4cdb-b8fd-a38aa3c0ab4f","resolution":{"observed_at":"2026-08-08T00:18:10.214093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04833","last_updated":"2024-07-19T07:39:37Z","snapshot_observed_at":"2026-07-06T17:56:40.208379Z","submitted_at":"2024-04-07T06:56:51Z","title":"ShoeModel: Learning to Wear on the User-specified Shoes via Diffusion Model","version":2},"cited_work":{"arxiv_id":"2404.04833","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.04833","snapshot_observed_at":"2026-08-08T00:18:10.635639Z","title":"ShoeModel: Learning to Wear on the User-specified Shoes via Diffusion Model","venue":"cs.CV","work_id":"0319d688-7415-4972-95ca-41c11bed9cf8","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.217865Z"},"links":{"cited_paper":"/paper/2404.04833","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:994a58c4103afed3e30f62232235983ff60b9adda31706061195131bfd6bc4d5","observation_id":"a8595954-eb33-4d3a-9114-9618ad39529d","resolution":{"observed_at":"2026-08-08T00:18:10.639924Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.250614Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"f6c66c91-61cb-433d-8661-ca08bfbbeb63","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.221664Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:46ce980de4d2ee73b466fb85dbdab1065e70967522d333c5b1fa0da525b7cfb1","observation_id":"75f636d7-241e-4a4b-8f1c-6bb1a71d8bc7","resolution":{"observed_at":"2026-08-08T00:18:11.254235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.240398Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (WACV) , pages =","venue":null,"work_id":"745110b8-a468-4bdd-aa31-178456b9b32f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.224985Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:bc27fa3177dcd4b3d772264abbea123381aa6e5f576862e51bed8bb69586bdd2","observation_id":"6732e5db-bc12-451e-a04a-844a71dac624","resolution":{"observed_at":"2026-08-08T00:18:11.244018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13795","last_updated":"2024-01-24T20:25:48Z","snapshot_observed_at":"2026-07-06T17:20:07.930031Z","submitted_at":"2024-01-24T20:25:48Z","title":"Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All","version":1},"cited_work":{"arxiv_id":"2401.13795","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.13795","snapshot_observed_at":"2026-08-08T00:18:10.619795Z","title":"Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All","venue":"cs.CV","work_id":"28d94f12-7e25-43ba-9e83-ccd823ee9e64","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.228076Z"},"links":{"cited_paper":"/paper/2401.13795","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ea7245391b89b82a1385e967640722efd468f4818b15aa81a4889bffaef006ef","observation_id":"c3973f0a-261a-49ba-84f5-de038375db0c","resolution":{"observed_at":"2026-08-08T00:18:10.623977Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.229993Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"b2240227-12f1-4fae-bba4-b96194b0271c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.231190Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2db260d6ca6536ba281e239499e2de4f4b23b6c07b4ebe7c3f6f4ca62c51b8c9","observation_id":"3f92caac-496a-483d-911a-c6087092c238","resolution":{"observed_at":"2026-08-08T00:18:11.233681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.219914Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"086f7fe0-7cef-43c1-b688-99893921ab72","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.234097Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a9f27e6aa0260c4628df2178140a61ba8fd05652194ea0b9876cee4b63dc2b0f","observation_id":"35380740-c71d-4d74-888d-135cb3a0d5a9","resolution":{"observed_at":"2026-08-08T00:18:11.223521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.209430Z","title":"CVPR Workshops , volume =","venue":null,"work_id":"33d8d08e-190d-420f-9a72-258475516ecc","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.237031Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ad82eddc967659b34b18861dad93b8df560fb25d6f3c38776d42ab2083e885e5","observation_id":"1fb7354c-469f-4c94-806c-9ccdc7243154","resolution":{"observed_at":"2026-08-08T00:18:11.213207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.199262Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence , volume =","venue":null,"work_id":"afa7c357-322f-46b3-a681-094804b88e2a","year":2002},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.239983Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b0fe501948e6f3b20a9dcacdb1677218b950428ed033a5f3f8dd73841f163164","observation_id":"f2fbc477-d27f-46be-aa85-5c45815067d1","resolution":{"observed_at":"2026-08-08T00:18:11.202532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.189803Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"36da16e5-51e6-4d09-9a25-f61d709af75c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.243072Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ac3880369c496c843c5f0fea9befabddee6914ae2968c4b2225f4b99db3d516f","observation_id":"3bd97ebd-4a52-4726-a87e-a52c94488a53","resolution":{"observed_at":"2026-08-08T00:18:11.192922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.180291Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"954f676e-1983-4157-b9cc-dca3d7ea8170","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.246085Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8637b35b7e129a726ca4f584354436bb8408936a50ba428540b7fb4f176c96f7","observation_id":"b9240e3b-3b38-48e7-9fa1-3c135ce8ed36","resolution":{"observed_at":"2026-08-08T00:18:11.183483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.170506Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"701ee831-ecbc-4dfe-8de0-ed38bf53d808","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.249085Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:d30af6ebf107d8982d68d431d9bfd3cb991308c983a3d9e649421828102805e2","observation_id":"ab67d358-ce58-4ae8-8526-6c11e79a25e5","resolution":{"observed_at":"2026-08-08T00:18:11.174048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.160233Z","title":"Proceedings of the ACM International Conference on Multimedia (ACM MM) , pages =","venue":null,"work_id":"6f207499-8e18-4cd4-9595-b9771a8c4f86","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.252378Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:77a24d41f13dc50a43493a13af88a20d9372e6c786dc4e938b6b03aa4d064827","observation_id":"da6d92b6-575d-4ca2-964f-c05f7619391a","resolution":{"observed_at":"2026-08-08T00:18:11.163866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.150032Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"8d3e7f54-d96a-42eb-a28e-9d70cdfe6ec8","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.255823Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:22b5ae87ed857039a256de0675240b24983526d7ec9a78d67cbba93d32217e78","observation_id":"f57d5a28-c656-4bc7-8657-f23e937a97a0","resolution":{"observed_at":"2026-08-08T00:18:11.153633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.139701Z","title":"Proceedings of the ACM International Conference on Multimedia (ACM MM) , pages =","venue":null,"work_id":"8de525f5-454b-431b-9f9e-2757611014b4","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.259035Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:5d9e31025d2d5afd95955200bb0776b83806a5320e012bdbf2fe6a203cf8846f","observation_id":"db354974-6214-4a7e-b63a-d7e3984c971e","resolution":{"observed_at":"2026-08-08T00:18:11.143218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.129313Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"b18ed031-71bf-44e6-92d4-26a09e64e595","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.262463Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:11599c0e9f38c2074fedb36b61d232574c5086b0f77c33f43d53db7451de982c","observation_id":"45a59f1f-d0f7-4004-88ff-04c191ffb252","resolution":{"observed_at":"2026-08-08T00:18:11.133240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.119435Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"e7775072-0bc6-4635-a264-a29d4cb62e7c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.265672Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:86a7e7ff902b8b252c6ba26f0cf9b16722874bf619b82285e729d4d38010e7b6","observation_id":"136ff12c-1786-4898-a17f-12b6e95e1f78","resolution":{"observed_at":"2026-08-08T00:18:11.122968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.109040Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"6e50a8f6-549c-4995-b82e-3f0b9af71932","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.269101Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8151e27e1788cae301e4a24e577be0f976b23ff025bda73a156dfe1b0e07bb51","observation_id":"4beb35cb-7482-45c7-84b1-a21a57c97a6c","resolution":{"observed_at":"2026-08-08T00:18:11.112695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.098745Z","title":"SIGGRAPH Asia 2024 Conference Papers , pages =","venue":null,"work_id":"5d4244a6-9211-4a35-8ef3-0c744408144a","year":2024},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.272670Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ad3f26866e00bfa7b88a2de6ae67768fcbff70e30575f7dff36c270b0e7ff975","observation_id":"f2ff5cd2-3b6f-40a7-aced-4efc0b2b540f","resolution":{"observed_at":"2026-08-08T00:18:11.102269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-08T00:18:10.276333Z","title":"arXiv preprint arXiv:2511.21631 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.276333Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b63fa2346ece704ee5bad9eca4989e28d89a9508202ca94e01de7bd843898e1d","observation_id":"f73797f8-ed8c-4519-8756-0de0c4351969","resolution":{"observed_at":"2026-08-08T00:18:10.276333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-08T00:18:10.279918Z","title":"arXiv preprint arXiv:2409.12191 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.279918Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f1b5a1b393df0b4df06173bdadbb45a8772f2c6034b5dbf13628ccd5b3a5abe2","observation_id":"523eed36-80a3-4e85-a1eb-eeb76394d55c","resolution":{"observed_at":"2026-08-08T00:18:10.279918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-08T00:18:10.283574Z","title":"arXiv preprint arXiv:2601.03267 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.283574Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:7f530bf58247c243a208ecc5a136f7a2a9ff54cb9573545c981600158eaaf67d","observation_id":"f635e137-aa16-46ce-927b-35f0610af67f","resolution":{"observed_at":"2026-08-08T00:18:10.283574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.088259Z","title":"IEEE/CAA Journal of Automatica Sinica , volume =","venue":null,"work_id":"4a808a7b-3a93-4fea-87b0-adcb2ec3181f","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.287112Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:fbe73ad463ebec9ac34d82787e38d4eb7505bed5191cd9565d5c957ec03f7677","observation_id":"f014d969-3601-41bc-ab8f-d0441c528dbc","resolution":{"observed_at":"2026-08-08T00:18:11.091975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-08T00:18:10.290960Z","title":"arXiv preprint arXiv:2507.06261 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.290960Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f6e3a6fe18ef1b875c9b764f7935a5c638f20f998e4c171d948a379d0840f1b7","observation_id":"08a9b915-051e-48dc-b54f-5efdaa367a9a","resolution":{"observed_at":"2026-08-08T00:18:10.290960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-09T15:40:38.938672Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-08-08T00:18:10.295235Z","title":"arXiv preprint arXiv:2601.07372 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.295235Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:4292d90a2b9f16f890deabbcb7ca1be3cbf27f4e8ea0f4e0ac1e599e2be25e1d","observation_id":"340ed926-34a7-4a88-8ee3-efdb3abc3c31","resolution":{"observed_at":"2026-08-08T00:18:10.295235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.077280Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"1a2cfa83-5377-4211-ad49-a3d6bbe17bb5","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.298739Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f668c6780eb66357e3f42305d71824d76452139314e976eaa8e4e0ff971a2322","observation_id":"9f85eb5e-af84-48bd-b036-5f2cc2e0694c","resolution":{"observed_at":"2026-08-08T00:18:11.081246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.066484Z","title":"arXiv preprint , year =","venue":null,"work_id":"8a3c87c7-31f4-48ca-9054-acfa7d1edb31","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.302258Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2fca6d13bbeb4a853180245500103546a79db381dec27a1bc8eda6953882bf45","observation_id":"6545ecda-1985-4d03-b997-ca1bac2174fe","resolution":{"observed_at":"2026-08-08T00:18:11.070054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.056347Z","title":"arXiv preprint , year =","venue":null,"work_id":"395e90a8-3788-473e-95b0-3d4eed0dc72f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.305573Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:1be5ae59b907194bd550d62af4618dc7b3a963062b03b406d3c87bcb2a438cd2","observation_id":"fedb7041-7940-4e55-aaf6-d1a4d45fd144","resolution":{"observed_at":"2026-08-08T00:18:11.059458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15574","last_updated":"2025-01-26T15:59:31Z","snapshot_observed_at":"2026-07-06T20:26:21.639525Z","submitted_at":"2025-01-26T15:59:31Z","title":"Instruction Tuning for Story Understanding and Generation with Weak Supervision","version":1},"cited_work":{"arxiv_id":"2501.15574","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15574","snapshot_observed_at":"2026-08-08T00:18:10.554666Z","title":"Instruction Tuning for Story Understanding and Generation with Weak Supervision","venue":"cs.CL","work_id":"185fd24a-19a1-4c98-950a-184af6314880","year":2025},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.308863Z"},"links":{"cited_paper":"/paper/2501.15574","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:53caa31f6606944cba6991587729f02ed98101068e2886c954a257aab0ba87d8","observation_id":"3e36189c-01d6-4e62-8598-2cf2efcd749c","resolution":{"observed_at":"2026-08-08T00:18:10.560699Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.046251Z","title":"Proceedings of the Annual Meeting of the Association for Computational Linguistics (ACL) , pages =","venue":null,"work_id":"09279676-9ff1-47d9-b87b-4b4bd80f98fd","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.312447Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:0ebd0495bbc7c3faa58fe6babc2d0457421e1dbfc98ebb586f1115d91c583621","observation_id":"5e8285c4-b30e-457e-971f-ddac0291644b","resolution":{"observed_at":"2026-08-08T00:18:11.049944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.315797Z","title":"arXiv preprint arXiv:2510.08485 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.315797Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:5e0889f93e4f603de41c9419ee3b1d76e0097ba075346e225719d39e6f18d238","observation_id":"36a91fea-9afa-4da8-8a9a-a062c4cacb5e","resolution":{"observed_at":"2026-08-08T00:18:10.315797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T00:18:10.319224Z","title":"arXiv preprint arXiv:2503.20314 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.319224Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:378bdadc0d2de507acdf45ac70ef559442a2f39418a48d0bde3740cf9afcba28","observation_id":"ca549662-9144-41c8-bc7d-ebb5ede9be20","resolution":{"observed_at":"2026-08-08T00:18:10.319224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.036410Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"2ec4c9d2-824b-49ff-88fb-2e72c59bb154","year":2021},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.322809Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:55964e0f5b5c615c13c7c96a7507a9e3618242f020eccc08ce996319fa7c596d","observation_id":"445aa634-98cf-4dd2-9c66-06d8b473e038","resolution":{"observed_at":"2026-08-08T00:18:11.039861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.026159Z","title":"Proceedings of the European Conference on Computer Vision (ECCV) , pages =","venue":null,"work_id":"537415c0-9cc8-4640-b82e-15adfd43b763","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.326114Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:95efb0a3f2bedb4335beb996300c02bcc0773d22052d66cdd4791425c748db76","observation_id":"036791ef-6453-4ea7-9ba4-9025c1756838","resolution":{"observed_at":"2026-08-08T00:18:11.029738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:11.014716Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV) , pages =","venue":null,"work_id":"1ebfcc96-21f4-426e-b95c-395226130f39","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.329734Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:d373a32875421f5892ba6e6447707d1f45e0faca21f0367e53debcfcc4c3669c","observation_id":"cc2062a4-d342-405b-8f17-b50603aee201","resolution":{"observed_at":"2026-08-08T00:18:11.018604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.333177Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.333177Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f77564517c79b1b9d9a2caab335393aeb7bd7c019958a44fdbe1dba5b16f3058","observation_id":"ddc73dc8-6b82-4998-9677-af08e88334fc","resolution":{"observed_at":"2026-08-08T00:18:10.333177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.997610Z","title":"GitHub repository , year =","venue":null,"work_id":"d581f1ed-95e6-4933-a851-61e4e3b1fc84","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.336265Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:487428cc57838bd3815ebf47f20ddc6e752aebd18d702554170db07bdc2ea425","observation_id":"aeb68214-6262-4225-ae02-f97b17862d14","resolution":{"observed_at":"2026-08-08T00:18:11.001344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.986665Z","title":"Demystifying","venue":null,"work_id":"9e4d9b70-2029-4e91-a5d5-054c514b1499","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.339219Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2e42555b57343bfe570a9733b8b5429d9843664fadc98ebb922329a88280b5d6","observation_id":"8e6edcbc-735f-41fd-b84c-23aaf1adafb5","resolution":{"observed_at":"2026-08-08T00:18:10.990128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.342186Z","title":"IEEE Transactions on Image Processing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.342186Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:df9219100252e5e7d1eebd374428519ee019cee0230903dd0bed37079fb864d0","observation_id":"ced65829-94ce-48e5-af16-fffcdc511b94","resolution":{"observed_at":"2026-08-08T00:18:10.342186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.969442Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"da498d05-3388-4482-8810-f9e375139295","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.345262Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:f7ad1e3a6860bec1028449c60304327529fbc4fe8eb69fa0d2e532e9cb721a17","observation_id":"2f8a7f18-e814-4b14-a410-17b4e439accd","resolution":{"observed_at":"2026-08-08T00:18:10.973307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.958687Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"0cf52777-dfb0-4d1e-8bb8-cd741f80b80a","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.348162Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:29031d4a04316ad4b14756d90984e3da2a20b6da18f858f16f14485f8b30db67","observation_id":"ec5f1ffe-2f69-4d3f-95c2-81c3fc9d92bf","resolution":{"observed_at":"2026-08-08T00:18:10.962510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.948288Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"10c93716-417d-4264-ab76-bfeadee19393","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.351052Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:8fbaa4bab237197969c501ae5ff4dc1ff0d97c5e18d544d2c9c8e0ed60afb809","observation_id":"10dfddaf-507e-4800-8d5e-4839d888a202","resolution":{"observed_at":"2026-08-08T00:18:10.951912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15886","last_updated":"2025-02-16T03:41:41Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-21T11:58:53Z","title":"CatVTON: Concatenation Is All You Need for Virtual Try-On with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15886","snapshot_observed_at":"2026-08-08T00:18:10.354134Z","title":"arXiv preprint arXiv:2407.15886 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.354134Z"},"links":{"cited_paper":"/paper/2407.15886","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:7e9450961b75d4f652f1d917c53a83d862331f66b8837f2c7d5c592c985a8c67","observation_id":"c0df6ca8-6e70-4718-94c8-ca9f565dd147","resolution":{"observed_at":"2026-08-08T00:18:10.354134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.937713Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence (AAAI) , volume =","venue":null,"work_id":"1392d852-16f4-4c5d-80ff-37b67f8c529f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.357423Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:ac0ebd7448e8429e9eaf6a3b3bce74c50fa39043185837e75e5b7d6484d1babb","observation_id":"b62e114f-653a-405b-bae3-05d8e00e19a2","resolution":{"observed_at":"2026-08-08T00:18:10.941446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16010","last_updated":"2025-07-21T19:09:28Z","snapshot_observed_at":"2026-08-09T15:48:09.108799Z","submitted_at":"2025-07-21T19:09:28Z","title":"FW-VTON: Flattening-and-Warping for Person-to-Person Virtual Try-on","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16010","snapshot_observed_at":"2026-08-08T00:18:10.360702Z","title":"arXiv preprint arXiv:2507.16010 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.360702Z"},"links":{"cited_paper":"/paper/2507.16010","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:a064d56a0cb3d110c9a14849ed8f6ab763ddf24687b9cef17d206c77cd1fc0b6","observation_id":"e59b9402-cab5-4281-adb5-b6dee5a4a464","resolution":{"observed_at":"2026-08-08T00:18:10.360702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T00:18:10.364433Z","title":"arXiv preprint arXiv:1711.05101 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.364433Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:309c5d4cdcd37443cc9f18d3847fad3feb0d742c7fbf673b5d98b58518a13830","observation_id":"aaaa009b-df71-46d4-b87c-0ffff95b0740","resolution":{"observed_at":"2026-08-08T00:18:10.364433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.926779Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , volume =","venue":null,"work_id":"ec972eb3-960c-468d-bbd6-e290a8d0553f","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.368399Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:69007d3754cf988c022a4e23a7ee67516ddac6cc11e1b55e08bffdc842585b99","observation_id":"1356253c-8c39-405c-9c3b-8d356d9527ed","resolution":{"observed_at":"2026-08-08T00:18:10.930707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.916061Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"2f0515f7-390d-456a-be41-6f847b13f6c1","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.372018Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:db458647f34ec7ee4cd3ba7624ecbbbd5873527fe027a5199b4d7fb78588181e","observation_id":"c9d7c87b-c664-452d-885a-bad739602f70","resolution":{"observed_at":"2026-08-08T00:18:10.919605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.905395Z","title":"Proceedings of the International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":"f3057d38-b716-4d2c-b7e4-a9bc3ee6e0b6","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.375640Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:bab61a28529128cfa204dfa448c102419666248e8774103fee9fcc2aad10819e","observation_id":"af90270c-f03d-4842-945f-41de6908b329","resolution":{"observed_at":"2026-08-08T00:18:10.909013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.895294Z","title":", author =","venue":null,"work_id":"b1d517a6-a3bb-4678-b67e-894925f63a2c","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.379197Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:b65be213e6587d3ef9d5f72194e918a67c0ffe8b09192a9492add0afb3e85470","observation_id":"ad8aad74-7668-444d-a366-7345d466dfdd","resolution":{"observed_at":"2026-08-08T00:18:10.898689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.885376Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , pages =","venue":null,"work_id":"1fd678d6-ea70-4f18-b5f3-e27636c53747","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.382823Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:edfd8507833c12788a479cb7efc418125dcc784aa6469eba417be6ea9c819a6b","observation_id":"3e296947-5269-488b-ad05-579b3e14cb4c","resolution":{"observed_at":"2026-08-08T00:18:10.888965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10730","last_updated":"2026-05-11T15:34:56Z","snapshot_observed_at":"2026-07-06T23:22:37.355450Z","submitted_at":"2026-05-11T15:34:56Z","title":"Qwen-Image-2.0 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10730","snapshot_observed_at":"2026-08-08T00:18:10.386228Z","title":"arXiv preprint arXiv:2605.10730 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.386228Z"},"links":{"cited_paper":"/paper/2605.10730","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:34569a56e5d1f99a581efa2bbd51d2d12f3ef1e43fdf1a39af76fd3be3ff99f1","observation_id":"0b1cd0c2-81a5-4bd0-9a59-19ed69b2d42a","resolution":{"observed_at":"2026-08-08T00:18:10.386228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:10.875399Z","title":"2: Frontier Visual Intelligence , author=","venue":null,"work_id":"3923a045-b0e7-453b-b195-5edbeef04597","year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.389722Z"},"links":{"citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:9c4078ac447627e34595b18d26efd9e6b0f6ceb10b46dcd8e7b5498e19374a6d","observation_id":"14a289dd-3cff-45b6-8131-5d01b55b2b21","resolution":{"observed_at":"2026-08-08T00:18:10.878729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T23:11:27.847872Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":42},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2608.05745."}