{"as_of":"2026-08-15T12:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:775b2ef99906259d5e5c6e1e22352e250208db407dfa5e7ebebc03bb5d147627","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:33:33.617642Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:10.191565Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T18:08:50.729202Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"cited_work":{"arxiv_id":"2506.21270","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.21270","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.21270 , year=","venue":null,"work_id":"3b707e1f-98c5-497c-99d0-b758faf4309e","year":null},"citing_paper":{"arxiv_id":"2605.16696","last_updated":"2026-05-15T23:19:43Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:19:43Z","title":"Face inpainting with Identity Preserving Latent Diffusion Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T18:05:54.603514Z"},"links":{"cited_paper":"/paper/2506.21270","citing_paper":"/paper/2605.16696"},"observation_digest":"sha256:3c638525ca2fe28ea4cde6bb351a82f121205efeff567c66f9ec9327ad09c031","observation_id":"772d1f57-9eec-4786-852c-b7a356c0d7c2","resolution":{"observed_at":"2026-05-20T18:08:50.730819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21270","snapshot_observed_at":"2026-08-08T00:18:10.191565Z","title":"arXiv preprint arXiv:2506.21270 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05745","last_updated":"2026-08-06T08:29:47Z","snapshot_observed_at":"2026-08-12T22:15:41.036433Z","submitted_at":"2026-08-06T08:29:47Z","title":"UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:10.191565Z"},"links":{"cited_paper":"/paper/2506.21270","citing_paper":"/paper/2608.05745"},"observation_digest":"sha256:2e7e9d4782b790184661b41db2b1854ee88c292375e3f578678699d89e50c02a","observation_id":"8aead11d-6794-4867-a0bb-00d0bfe66a75","resolution":{"observed_at":"2026-08-08T00:18:10.191565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.21270/citation-record","integrity":"/paper/2506.21270/integrity","json":"/paper/2506.21270/citation-record.json","paper":"/paper/2506.21270"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.756281Z","title":"Multimodal garment designer: Human-centric latent diffusion models for fashion image editing","venue":null,"work_id":"c4d60a06-063a-42cc-ad09-665d790e57ac","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.130006Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:efd697ddfc8a2fc0a8aed8a68490b546ab4f254c9b9f78d36973e1bda90e64f4","observation_id":"4da504b8-658f-49aa-9856-91d0382d0f45","resolution":{"observed_at":"2026-08-06T22:33:38.830638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00737","last_updated":"2019-05-02T13:40:43Z","snapshot_observed_at":"2026-08-14T16:38:13.998300Z","submitted_at":"2019-05-02T13:40:43Z","title":"The 2019 DAVIS Challenge on VOS: Unsupervised Multi-Object Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00737","snapshot_observed_at":"2026-08-06T22:33:28.229378Z","title":"The 2019 davis challenge on vos: Unsupervised multi-object seg- mentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.229378Z"},"links":{"cited_paper":"/paper/1905.00737","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:f29f1e4e1f4099d4a6b69b20ad42f1c7b7e26da3ba7c3a20b117f3bab789ffdb","observation_id":"c5fe83e3-5150-485e-873e-8f251aa87368","resolution":{"observed_at":"2026-08-06T22:33:28.229378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.549283Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset, 2018","venue":null,"work_id":"d14da306-fa0f-4ec3-825e-1520db209685","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.364085Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:90355443ff7f309a7c0faae8de45a20a6c63f633f109c02c1591bafa64119dbc","observation_id":"30c22c77-3ef0-47d7-a9ee-ba279a7bd374","resolution":{"observed_at":"2026-08-06T22:33:38.648481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01090","last_updated":"2025-04-28T07:47:49Z","snapshot_observed_at":"2026-08-14T08:37:35.334809Z","submitted_at":"2023-11-02T08:55:11Z","title":"Infusion: internal diffusion for inpainting of dynamic textures and complex motion","version":4},"cited_work":{"arxiv_id":"2311.01090","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.01090","snapshot_observed_at":"2026-08-06T22:33:33.994826Z","title":"Infusion: internal diffusion for inpainting of dynamic textures and complex motion","venue":"cs.CV","work_id":"19bd1a03-099f-4ef5-a9b8-996562cd02d9","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.466276Z"},"links":{"cited_paper":"/paper/2311.01090","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:343ce9ab366a81839b33dfa5d39854f9b104ebe394d753bfd442504c9c978903","observation_id":"86abadc0-6f9b-4d0a-8f24-ad10a82f2273","resolution":{"observed_at":"2026-08-06T22:33:34.048052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.375345Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"4d99c8be-7638-4745-951c-2f0b76c9ecca","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.583609Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:4a8a39c98ff8addd74e86b61bc3400f650cd8b95cd5ca6246f8c39af63488ec3","observation_id":"b76e3d61-e6b4-422f-a27a-cf705e093132","resolution":{"observed_at":"2026-08-06T22:33:38.462091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.232930Z","title":"Mevis: A large-scale benchmark for video segmentation with motion expressions, 2023","venue":null,"work_id":"cd93aeac-c19b-4c31-907e-adcae5411eea","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.707724Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:1ca80aec52b4415ba95bcf6d6612e58c159c4e7cdce1f3fd203bc1425be98bbb","observation_id":"e4b0043b-bf53-4a9d-92b8-25817ed08c54","resolution":{"observed_at":"2026-08-06T22:33:38.319265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:38.055341Z","title":"Fw-gan: Flow-navigated warping gan for video virtual try-on","venue":null,"work_id":"4d4e80b3-3346-4cf2-a8b0-ee042665526d","year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.820294Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:a70cdab2f9a0c800f06a2f18dd33d55ff3eac6bdda7bf50e82a9a4000adb177b","observation_id":"5d566195-28f4-4269-8b78-4d66757409c2","resolution":{"observed_at":"2026-08-06T22:33:38.137651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.863391Z","title":"Vivid: Video virtual try-on using diffusion models","venue":null,"work_id":"13215e00-bb19-4a70-82cc-b2cfb375bae4","year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:28.914502Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:a17cc93d655f925b3758beeef8b2895dab0a1ae5ed5a54e22247c4032243a025","observation_id":"43963753-5b8a-4570-94bf-d7707685368b","resolution":{"observed_at":"2026-08-06T22:33:37.959635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.671068Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"319f03ff-4297-4358-90fd-cb555e4ef246","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.024352Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2498671af4d5b68fa6dee0a1ae72c0e557ee031cd236714bf0fc7f22282bfaaf","observation_id":"2ff9778c-5ad3-4847-82e6-c1865e718b57","resolution":{"observed_at":"2026-08-06T22:33:37.773245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.481419Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"ab094aec-198c-49ab-ab60-6c2be996c7c7","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.167956Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:5dd1cfedf44ad50acd2313096c9c316925d1e5ab518882bd70c54f3b3946cc44","observation_id":"fa92ef1f-77b5-4976-b5ae-ebf7ee28abb9","resolution":{"observed_at":"2026-08-06T22:33:37.573227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.276139Z","title":"Parser-free virtual try-on via distilling appearance flows, 2021","venue":null,"work_id":"9122f336-0788-4214-a3fc-7ff962ac5c3e","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.287736Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:903e8a114344fa88dc99bb2ffd5879140b1b94103edaf21203dbf50ca4e835ec","observation_id":"4fa4f9d1-50ad-4bf1-8ec1-8ce277cb7f73","resolution":{"observed_at":"2026-08-06T22:33:37.358343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06101","last_updated":"2023-08-11T12:23:09Z","snapshot_observed_at":"2026-08-14T20:19:30.343860Z","submitted_at":"2023-08-11T12:23:09Z","title":"Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06101","snapshot_observed_at":"2026-08-06T22:33:29.377884Z","title":"Taming the power of diffusion models for high-quality virtual try-on with appearance flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.377884Z"},"links":{"cited_paper":"/paper/2308.06101","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:bb006873fad541a318254a963cb089d23d6b7145473a838f0a031ea69d0fd9ca","observation_id":"2e247f7b-bdb1-43ff-9a70-f9b6dcc59781","resolution":{"observed_at":"2026-08-06T22:33:29.377884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00251","last_updated":"2024-10-08T23:30:47Z","snapshot_observed_at":"2026-08-13T00:17:58.488082Z","submitted_at":"2024-04-30T23:49:26Z","title":"Semantically Consistent Video Inpainting with Conditional Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00251","snapshot_observed_at":"2026-08-06T22:33:29.485730Z","title":"Se- mantically consistent video inpainting with conditional dif- fusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.485730Z"},"links":{"cited_paper":"/paper/2405.00251","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:903ac3145f73dcdf5d3e55b6ede6284dff1726cf631861506ff17e3bda2c2dd2","observation_id":"82790a37-c18b-4bfb-9bd7-c7670d967064","resolution":{"observed_at":"2026-08-06T22:33:29.485730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15368","last_updated":"2025-01-23T03:24:01Z","snapshot_observed_at":"2026-07-06T16:52:31.421394Z","submitted_at":"2023-11-26T17:48:48Z","title":"Flow-Guided Diffusion for Video Inpainting","version":2},"cited_work":{"arxiv_id":"2311.15368","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15368","snapshot_observed_at":"2026-08-06T22:33:33.831357Z","title":"Flow-Guided Diffusion for Video Inpainting","venue":"cs.CV","work_id":"4354f191-5af5-44d6-895d-1777b4701f50","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.600770Z"},"links":{"cited_paper":"/paper/2311.15368","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:d58514b7e88067fb44351ac3099689067309ac0998f25483f9fd75d970eca766","observation_id":"d37e7bbd-e460-4ef1-a06f-4f0c2dfb65fc","resolution":{"observed_at":"2026-08-06T22:33:33.868933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:37.144882Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"82ac525a-2453-4a04-8cf4-e7755595e161","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.701986Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:aba8d4becdd3cf0e87f4eb386e9a11da4b932ced1bf3b03bd9c231ed197bccb4","observation_id":"c955eee1-e158-42e9-b18a-4584b5692b7a","resolution":{"observed_at":"2026-08-06T22:33:37.196980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.995625Z","title":"Densepose: Dense human pose estimation in the wild, 2018","venue":null,"work_id":"10bea047-43a4-4758-ab72-faabfb4f654c","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.812495Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:30805ea90cb3c0f072ca769dd27c67d0bd0dd47b8140bed4347355352ccf8508","observation_id":"0cf3e20f-8587-4baf-af58-07ddb0a992de","resolution":{"observed_at":"2026-08-06T22:33:37.069351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.862921Z","title":"Viton: An image-based virtual try-on network","venue":null,"work_id":"e465afbc-44ad-4cb5-8646-65dc00f31774","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:29.946334Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:c899907948124f490028a80b6d0fe87f19ba9d47fcd530b5846429aad7382954","observation_id":"a2bac317-7c1b-4180-b086-88d980d18e2c","resolution":{"observed_at":"2026-08-06T22:33:36.927008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.709544Z","title":"Can spatiotemporal 3d cnns retrace the history of 2d cnns and imagenet?, 2018","venue":null,"work_id":"057070a6-27a6-40ec-8c3a-b92a58f179bf","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.045522Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:53ed6404582e07ac7ee76edd8009b7235ad89f917f55a3dfbd8d0fd0c9927faf","observation_id":"f85ceb3e-461f-4e2d-894d-91ee0ee06b8b","resolution":{"observed_at":"2026-08-06T22:33:36.766348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10625","last_updated":"2024-07-15T11:21:03Z","snapshot_observed_at":"2026-08-12T23:22:07.412007Z","submitted_at":"2024-07-15T11:21:03Z","title":"WildVidFit: Video Virtual Try-On in the Wild via Image-Based Controlled Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10625","snapshot_observed_at":"2026-08-06T22:33:30.153754Z","title":"Wildvidfit: Video virtual try- on in the wild via image-based controlled diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.153754Z"},"links":{"cited_paper":"/paper/2407.10625","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:c5c88711181c98ef380142de554b2aca19f09a8976de5edb3d1330c1433f37e0","observation_id":"1cdfd2c2-24cb-47fa-b02b-f12623b03e25","resolution":{"observed_at":"2026-08-06T22:33:30.153754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.562449Z","title":"Lvos: A benchmark for large-scale long-term video object segmentation, 2024","venue":null,"work_id":"0dc06873-7a3a-4401-93b6-bf40c3e9e1ec","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.282570Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:3d6c971b3492475250ed04c906a5ab7276770dacaf40910e9319fa7986e81bf9","observation_id":"8ae0c3fe-66ee-4a3d-b5f0-c6045e6d59b9","resolution":{"observed_at":"2026-08-06T22:33:36.627797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.422995Z","title":"Do not mask what you do not need to mask: a parser-free virtual try-on","venue":null,"work_id":"7f9f4185-5d1a-423d-82fa-5cb099f37520","year":2020},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.367598Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:c8fafc075aafb917828b8cd07fc7a719c814563ba4ef31993098b203fe18c018","observation_id":"c19bd4a9-60c4-4389-ad77-dd2c1a67c550","resolution":{"observed_at":"2026-08-06T22:33:36.482460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.254438Z","title":"Cloth- former: Taming video virtual try-on in all module","venue":null,"work_id":"9598ef3d-19ad-4fab-bdb0-8ed9e19fdd75","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.498552Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:d604858cd0133c79fab8a8602d4800c95f85a475b1a37538e43c7d9f23e8c355","observation_id":"bed5dc4e-f542-44b2-809c-ccb53083ec32","resolution":{"observed_at":"2026-08-06T22:33:36.354413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-15T10:20:49.234442Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T22:33:30.636955Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.636955Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:75b0ce0dbcda0e9219c8be6fd65c18990e3fcfcb262458c979ebe3b7e2ec1dfe","observation_id":"df1e7e3f-843f-4dd4-87b8-45e8c909f101","resolution":{"observed_at":"2026-08-06T22:33:30.636955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01725","last_updated":"2023-12-04T08:27:59Z","snapshot_observed_at":"2026-08-13T05:10:37.078945Z","submitted_at":"2023-12-04T08:27:59Z","title":"StableVITON: Learning Semantic Correspondence with Latent Diffusion Model for Virtual Try-On","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01725","snapshot_observed_at":"2026-08-06T22:33:30.776150Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.776150Z"},"links":{"cited_paper":"/paper/2312.01725","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:31fefbe634bd2091476398aadded2f1b6f8966266dda847ce89cd6087b38fe85","observation_id":"5ec1507b-2488-4acd-9268-a597b80ff799","resolution":{"observed_at":"2026-08-06T22:33:30.776150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:36.125928Z","title":"Stableviton: Learning semantic correspon- dence with latent diffusion model for virtual try-on","venue":null,"work_id":"c65c97bc-03cc-462d-aae6-6165c70341b4","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.927390Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:8a90012bdb693ec8bd66a0ec59c416a965c9c34da592fb129ea7be86f1accbfb","observation_id":"030a11b4-a825-4188-9647-d1e400ead44d","resolution":{"observed_at":"2026-08-06T22:33:36.193538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.995949Z","title":"Open-sora-plan, 2024","venue":null,"work_id":"b2f94c83-9c6b-4e75-800b-25ffccc38ab9","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.056768Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:ed014e23d2b2578cb5ccda62bfe9f79a2622ca4627c120153c1e2e670cb71b30","observation_id":"f118e0eb-ff22-4092-adaa-dd5111e58235","resolution":{"observed_at":"2026-08-06T22:33:36.046597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.872607Z","title":"High-resolution virtual try-on with misalignment and occlusion-handled conditions","venue":null,"work_id":"ae8a116a-3dda-4536-803e-9415ff004ea7","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.155436Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:bb51386b6dcdaed3ea8b78602099f9653ddff96a19537220051c610683e0969d","observation_id":"e52269dc-b746-4ea1-bd4c-bf5687db597b","resolution":{"observed_at":"2026-08-06T22:33:35.927669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.724124Z","title":"Latte: La- tent diffusion transformer for video generation","venue":null,"work_id":"9ed9429e-31a6-43db-9f6f-57905d90dcea","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.251033Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:55e747e12e05a91c15fe2bef8157cc7959002c1b8e46062bbf65d78e9a2d4263","observation_id":"dca791a6-3dfa-4bd4-a633-6cfb12d83e8f","resolution":{"observed_at":"2026-08-06T22:33:35.797280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.585700Z","title":"Dress code: high- resolution multi-category virtual try-on","venue":null,"work_id":"a116a421-6ac2-4138-8a7b-0c737bcc9ff0","year":2022},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.348309Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2879b353af00f7b525936d1038fa0c3a2982dddb60a27dc6fcccb12d19c2a34a","observation_id":"834aaa02-2e77-4929-8cdf-730915ac3890","resolution":{"observed_at":"2026-08-06T22:33:35.616540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.467809Z","title":"LaDI- VTON: Latent Diffusion Textual-Inversion Enhanced Virtual Try-On","venue":null,"work_id":"8e2566ac-cb2f-4a32-97a8-1279103230e8","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.486573Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:0679342acb21f90be1b1ad093acddfb68296ff01f6b9b6954d80b8382601b3c0","observation_id":"ece7d6be-8a9f-47b0-bd4d-1da9cb9f9281","resolution":{"observed_at":"2026-08-06T22:33:35.505553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:31.610157Z","title":"Dinov2: Learning robust visual features with- out supervision, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.610157Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:d57c6a2a95dc53c4997b03cd410d397f5370bdcafc1edab750db7a19c9b4c926","observation_id":"30adfadd-e849-4094-9a9a-83579d89e74b","resolution":{"observed_at":"2026-08-06T22:33:31.610157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.327346Z","title":"The 2017 davis challenge on video object segmentation, 2018","venue":null,"work_id":"37d699b6-9cbd-47ea-9a53-f507da4d9f40","year":2017},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.770602Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:a855eb48b61d9b228e24af385ac10772399cc5b9a228d37fbb9760be8bc37899","observation_id":"0762a723-99d2-4681-a5fa-2c1b42a823fd","resolution":{"observed_at":"2026-08-06T22:33:35.382792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.166209Z","title":null,"venue":null,"work_id":"d272c311-9576-4b5e-b4e9-dc9c1f906fc0","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.870473Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:b1cc7b7d91dc72a5b821043657c34d2e574428f283c7fe91584971224984c8b8","observation_id":"1fa47860-afac-412a-97ba-0d5b868997e3","resolution":{"observed_at":"2026-08-06T22:33:35.247398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-15T00:26:15.250313Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-06T22:33:31.977615Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:31.977615Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:9f38f9dca6e1225833d06e0b98a00bf2329fce1f2010b7963980ad9d07d54bbf","observation_id":"2c8c0f27-f62a-45d2-9f7e-075a9e081272","resolution":{"observed_at":"2026-08-06T22:33:31.977615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:35.011473Z","title":"Toward characteristic- preserving image-based virtual try-on network, 2018","venue":null,"work_id":"df4025fb-a0ba-4328-9ca3-f8670f549aca","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.086558Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:82bb37d6243f3130cf1f64cf046be59a6e9b2ae94a062a0d35ae02ed276e4ca6","observation_id":"bec30d08-8efc-4416-9289-cedd85a2a0b7","resolution":{"observed_at":"2026-08-06T22:33:35.072731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.887483Z","title":"Toward characteristic- preserving image-based virtual try-on network","venue":null,"work_id":"6edf421f-4914-48a1-94df-343ab92aaf13","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.226653Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:e7ed163d04e9eea53d046e1ced9b66e44b0ec180a649687f7b0be3f7f2b23c4a","observation_id":"ed80d764-744f-407b-bc1e-c44d079dec11","resolution":{"observed_at":"2026-08-06T22:33:34.947162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:32.356796Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.356796Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:8040fe1973f3f1ec0bb545cb0607e4ff81f9adce98ce25fd413dbbb2595bd8aa","observation_id":"f5e7ccc1-7b6e-4477-80bd-a6ff518af292","resolution":{"observed_at":"2026-08-06T22:33:32.356796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01779","last_updated":"2024-03-07T06:35:35Z","snapshot_observed_at":"2026-08-13T04:04:21.588263Z","submitted_at":"2024-03-04T07:17:44Z","title":"OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01779","snapshot_observed_at":"2026-08-06T22:33:32.539943Z","title":"Oot- diffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.539943Z"},"links":{"cited_paper":"/paper/2403.01779","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:e692e7db5131c7b0e45cc8afe702238c140657f53a3e3aa70c0ee743f6aa4f99","observation_id":"f64a0805-f465-4100-9954-2b7768857b03","resolution":{"observed_at":"2026-08-06T22:33:32.539943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.734223Z","title":"Tunnel try-on: Excavating spatial-temporal tunnels for high-quality virtual try-on in videos","venue":null,"work_id":"11d94e1a-63dd-4fc1-b2be-6bde4ff48398","year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.686910Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:bd4e8416f206598c21e8e2c412429c685500a6086adb9dc81a0d43c5ad1940b4","observation_id":"119d3a1f-21ae-40f0-b202-6f6dba68eb44","resolution":{"observed_at":"2026-08-06T22:33:34.795704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.583755Z","title":"Video instance seg- mentation, 2019","venue":null,"work_id":"82d56372-c248-4612-a328-a3912adb8499","year":2019},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.817596Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:0584226d6ca9969946159dea4b228952cdac083a5340b82c4b184aa15f5263ca","observation_id":"902f8d4d-5392-4f98-8acd-6ba4ba799089","resolution":{"observed_at":"2026-08-06T22:33:34.646272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-06T22:33:32.970229Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:32.970229Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:782228abf745f1393a846b442830a16530fbefce6216e8c721994ccc94b2ea8a","observation_id":"d864a82e-59da-458c-8094-de70db713b8f","resolution":{"observed_at":"2026-08-06T22:33:32.970229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.425931Z","title":"Efros, Eli Shecht- man, and Oliver Wang","venue":null,"work_id":"4acaf639-1487-4b9e-944d-0696274b7397","year":2018},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.065750Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:ce5877007f77057ea589cc3a4f56d0bab1553f921ee6921a65fd6404a7f590ed","observation_id":"07ff8f12-9be4-4c67-b683-aa5ffd2cfb0a","resolution":{"observed_at":"2026-08-06T22:33:34.489117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:33.178701Z","title":"Avid: Any-length video inpainting with dif- fusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.178701Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:9b3a4ba4b4ebfec161300047ebf604f41c84419b53732789975da384ee01bed7","observation_id":"b2ac43eb-3ba7-4205-816f-a3301b07aa98","resolution":{"observed_at":"2026-08-06T22:33:33.178701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.252834Z","title":"Mv-ton: Memory-based video virtual try- on network","venue":null,"work_id":"d9608fc5-a66e-4bf9-bb3c-b602e979e669","year":2021},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.346990Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:20fe34ef747eafb19ef5631deee629d3034afc51b1a92ccd6a917ae2ac8b7943","observation_id":"06fc2638-a7e5-448c-bd90-16441dd3c15a","resolution":{"observed_at":"2026-08-06T22:33:34.317961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:33.480997Z","title":"Tryondiffusion: A tale of two unets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.480997Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:0ec0fc2fbf95aff7e1335276dfac1bafc88a4888c94d154c4aaef1e52f47e09a","observation_id":"eb52d74a-714a-4274-b656-d9fd60f49ca4","resolution":{"observed_at":"2026-08-06T22:33:33.480997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:33:34.136630Z","title":"Designing a better asymmetric vqgan for stablediffusion, 2023","venue":null,"work_id":"a13802cd-7f5d-4418-8af9-f162742b5204","year":2023},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:33.617642Z"},"links":{"citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:2e88d857921507d9629b18ea18c5734dc57688ca11c4a56b4425ce47df520da6","observation_id":"805e54d5-7867-48cf-9aee-df9e213d18f2","resolution":{"observed_at":"2026-08-06T22:33:34.177378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T01:55:22.799819Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":30},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2506.21270."}