{"as_of":"2026-08-10T07:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ecb9395ca06b9465bcdf6dd5188bd2e7b6b2e8e7cd1651e7a63668c54abcc89","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:54:52.001571Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16980/citation-record","integrity":"/paper/2505.16980/integrity","json":"/paper/2505.16980/citation-record.json","paper":"/paper/2505.16980"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-09T15:04:43.257424Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-07T14:54:45.461870Z","title":"Latent-shift: Latent diffu- sion with temporal shift for efficient text-to-video genera- tion.arXiv preprint arXiv:2304.08477, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:45.461870Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:8f249fde8c756ef46425db39bf6a7e963e95e9d0f874c0dc9e170b4edd5f58f4","observation_id":"31de54fd-0a01-4c70-a949-50052a0a5e8c","resolution":{"observed_at":"2026-08-07T14:54:45.461870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:02.515427Z","title":"Demystifying mmd gans","venue":null,"work_id":"8b1d3e16-53a6-445e-964e-19210d6a3303","year":2018},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:45.579024Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:462094f3ff0519cb9ab928c08cf31609afa32a1bef76705b6d2d90aaf41182d7","observation_id":"ae735548-e7e1-4871-b738-b83402ecd322","resolution":{"observed_at":"2026-08-07T14:55:02.680793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:02.357862Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":"49046026-f033-45c3-9b8d-ffa697c1c337","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:45.709886Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:dddd1b9e40235f9988282a04eb095f71640e9bf2e447a1f87a56b347d9cf7564","observation_id":"09bc8d61-80a5-4c6a-801d-de7bb891ffe3","resolution":{"observed_at":"2026-08-07T14:55:02.413879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:02.139562Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":"335469bb-9e5f-4715-ac03-f7a5ec969bb5","year":null},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:45.823232Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:9e0991e60dcc4346b7a6f918d6705e23c5139f4c805ed69d1450d7de5f2171b6","observation_id":"481f4034-d846-423f-b93c-1477b12fa1a0","resolution":{"observed_at":"2026-08-07T14:55:02.257127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.976520Z","title":"Wear-any-way: Manip- ulable virtual try-on via sparse correspondence alignment","venue":null,"work_id":"f07534cd-2312-4177-b957-2d4c0c24b2ac","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.023597Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:7fe9b0b704ac97b365c51505f75fdd61855044b92a0fd07bdb43a7478b119687","observation_id":"fe7cbefc-17c5-4cc4-9f84-58a2b3836f50","resolution":{"observed_at":"2026-08-07T14:55:02.049393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.768848Z","title":"Text-to-3d using gaussian splatting","venue":null,"work_id":"984100aa-1385-48b2-964b-c6ddbdb1e7f1","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.145693Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:09be7c5c00ddceb9e577b2da5605fce2189d092ddb5ac22b8098744e432090f9","observation_id":"aa9cf882-1347-4ea7-9c88-c12f79e40931","resolution":{"observed_at":"2026-08-07T14:55:01.877717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.613181Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"4969e837-58aa-41c9-b8b5-7508a5fdecdf","year":2021},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.249407Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:1c4da742a0a9d1ee79cbbe9b26007a03eff973a9df4cbc322fb929723fd3688a","observation_id":"9a1da9e0-4c92-4f15-857a-38ab2b011157","resolution":{"observed_at":"2026-08-07T14:55:01.683855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.466859Z","title":"Improving diffusion models for au- thentic virtual try-on in the wild","venue":null,"work_id":"d0c3af7b-d3e9-4d71-8838-292f81d40d6e","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.364039Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:99a26ddf8c37558e7a2b9f72efd00141f8da092c0d4a00f68f9dcb8e199c8d09","observation_id":"4dec85d0-f884-423f-8b1f-3a4d0a48fd53","resolution":{"observed_at":"2026-08-07T14:55:01.517204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.283580Z","title":"Diffusion models in vision: A survey","venue":null,"work_id":"bfdf03a6-8025-4dfe-92e8-27ffe3712055","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.517066Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:748696a1dd22605440ca5fcc9935120c0b5492be2c62163a7a9741081095b07f","observation_id":"ea1842d5-a030-4598-8f60-36bdf0aeb641","resolution":{"observed_at":"2026-08-07T14:55:01.378312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:01.129447Z","title":"Fw-gan: Flow-navigated warping gan for video virtual try-on","venue":null,"work_id":"b9990ae4-2f75-4afb-820e-13520cca4ece","year":2019},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.640632Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:7fe5c5954642740c64ea3ab37a3797b9ae8a0e647d497d62ee9d85e329c2c2bc","observation_id":"748eb85c-f3aa-4ba3-a248-99e8254ec78a","resolution":{"observed_at":"2026-08-07T14:55:01.206852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.948957Z","title":"Fash- ion editing with adversarial parsing learning","venue":null,"work_id":"8b37dad6-63fb-4389-aaed-5d5e36fb4880","year":2020},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.754191Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:0d1f974d8b56dbb379dca9f46cbeb57e50e21449d4acfb17329eb715c0e569c7","observation_id":"9d72fa02-4239-4f01-8ac1-227db02e3824","resolution":{"observed_at":"2026-08-07T14:55:01.014164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11794","last_updated":"2024-05-28T04:08:09Z","snapshot_observed_at":"2026-07-06T18:16:33.179338Z","submitted_at":"2024-05-20T05:28:22Z","title":"ViViD: Video Virtual Try-on using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11794","snapshot_observed_at":"2026-08-07T14:54:46.900677Z","title":"Vivid: Video virtual try-on using diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:46.900677Z"},"links":{"cited_paper":"/paper/2405.11794","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:a2953bd56c73c0973f0b6c8fb3de661d169de28c73a1c1130a543d4371e928fe","observation_id":"17d2f49a-0671-4497-b1c6-0cbad644d52b","resolution":{"observed_at":"2026-08-07T14:54:46.900677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.792162Z","title":"Guess: Gradually enriching synthesis for text-driven human motion generation.IEEE Transactions on Visualization and Computer Graphics, 30 (12):7518–7530, 2024","venue":null,"work_id":"267fe745-1e7f-4e43-a1ad-d0dd21c25832","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.020047Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:41e0c87f26ea76c9ea178a14ef86cf2ec4e402a5ddf0d61102c062ca63d20e27","observation_id":"d5340c16-111d-484c-a25a-9d2322e9e55d","resolution":{"observed_at":"2026-08-07T14:55:00.885353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.623563Z","title":"Parser-free virtual try-on via distilling appearance flows","venue":null,"work_id":"b14a6b5f-2a3b-4087-bd21-5f57332c0adb","year":2021},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.155156Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:d043ad5afe40c0295ba4178ab2519a274ef9526c8cc6ac1d8d45eaec39e14482","observation_id":"58856eaf-444e-4cc1-ab02-becfca474bfe","resolution":{"observed_at":"2026-08-07T14:55:00.682411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:47.268299Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.268299Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:5161b086971d4ce15287effdb801b337afda1931e04896f2fcc60b0f862b2171","observation_id":"ffb14a1b-df04-4ba2-99da-b62f321b26e3","resolution":{"observed_at":"2026-08-07T14:54:47.268299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.377076Z","title":"Taming the power of diffusion models for high-quality virtual try-on with appearance flow","venue":null,"work_id":"76cec247-8961-43ab-8aa7-fba0381fa151","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.398513Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:ff7133f4108646851a402a589cbcf07138b32615166c75b489e6c4ddcf47359f","observation_id":"fb31ce22-490d-4f7a-9899-5975c5070a0a","resolution":{"observed_at":"2026-08-07T14:55:00.483375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:55:00.159089Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":"69c70cc1-014b-412e-9e29-457f6e0dab14","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.556586Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:5e15e03ea0be2556b3e177700b7e2f298edccb0cee395dc4358ee29c2fa775c8","observation_id":"5b1a0776-90f1-480a-a713-6f1cddcc3804","resolution":{"observed_at":"2026-08-07T14:55:00.256534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.925526Z","title":"Generatect: text- conditional generation of 3d chest ct volumes","venue":null,"work_id":"bda82571-de1a-4c71-a24e-5c064af678dd","year":null},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.705423Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:5b56c1868f70cf682f2784a4e682d97d3ab8a73bb2dc88d7168bc349508a376e","observation_id":"45b717ba-696d-4040-8248-e8191b09e622","resolution":{"observed_at":"2026-08-07T14:54:59.994308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.727810Z","title":"Viton: An image-based virtual try-on network","venue":null,"work_id":"46048f1d-a3fd-4917-a9dc-85f449015d0a","year":2018},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.815141Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:39fe5f2c97037098f681415b644bb5ed31921eb21fe53bff01cc62b691dddb89","observation_id":"ffe29e89-92fc-44f1-997a-49c46513b22b","resolution":{"observed_at":"2026-08-07T14:54:59.832387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.492027Z","title":"Can spatiotemporal 3d cnns retrace the history of 2d cnns and imagenet? InCVPR, 2018","venue":null,"work_id":"73962e90-1329-445a-acab-64450b60194e","year":2018},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:47.921241Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:dfc55553788ffc6434ea810241dafcc16bc2435d0666148b594cdf9ca3b7b768","observation_id":"89f0fbdd-5fe2-432c-ab8c-62c888f5c9d0","resolution":{"observed_at":"2026-08-07T14:54:59.569102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.400925Z","title":"Wildvidfit: Video virtual try- on in the wild via image-based controlled diffusion models","venue":null,"work_id":"01966f2f-b5c1-4454-a947-ea86f1c0d966","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.034929Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:8c609ec567cc1f7251869991d9cd248c6b851a4443ee88b46f00265f497488a8","observation_id":"bf274686-edd7-4e45-81ec-d7641d9001e7","resolution":{"observed_at":"2026-08-07T14:54:59.478415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:48.120463Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.120463Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:11f6bcdb3bf2088c54306dffce6dd8ba48fd1c20a980a6e9c7d3f094aaf6f9bc","observation_id":"1df23c6b-0e61-4508-8c22-79569d566e11","resolution":{"observed_at":"2026-08-07T14:54:48.120463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:48.208158Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.208158Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:7e67f7136eb3319708a263cf88116387dc0b694fdb91eb8d8236c53144c495a8","observation_id":"2d7ce898-5b34-447f-8ae3-c3815ea5b629","resolution":{"observed_at":"2026-08-07T14:54:48.208158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.224830Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"e443a174-b502-4c68-8e9e-47466686acfe","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.305071Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:a195744f321105dce31aa98a70fb74ded729c1a176bcad8c9ce085b5bf6d42c5","observation_id":"268b8033-9b4d-436b-a8c0-f8a882679739","resolution":{"observed_at":"2026-08-07T14:54:59.291228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:59.014398Z","title":"Training- free content injection using h-space in diffusion models","venue":null,"work_id":"0be03b5c-65c0-49a3-81ac-0b04433a2b3c","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.406700Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:9d52fe9689829911059dfd97168034229764bb61cc7f6e72395032ea44d75812","observation_id":"a194b987-7859-43cf-adeb-9cf120f19dd8","resolution":{"observed_at":"2026-08-07T14:54:59.128280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.831576Z","title":"Cloth- former: Taming video virtual try-on in all module","venue":null,"work_id":"49bc7ce6-677f-4b01-b425-cc2f33466412","year":null},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.536598Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:3f5f58c513a251da7efc41011c0dc9cadf12f8016beeab22f51f63bab43a6954","observation_id":"0bbf66eb-476d-4bd3-954a-055438f223b1","resolution":{"observed_at":"2026-08-07T14:54:58.916893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T14:54:48.615361Z","title":"Adam: A method for stochastic opti- mization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.615361Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:4b9ac3c568c8789961edb45103eea914b3fdc82c43ed9daebef65ff70bdcbfa3","observation_id":"2df0f845-d423-41fb-86d4-d79ce78360f4","resolution":{"observed_at":"2026-08-07T14:54:48.615361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.678619Z","title":"Shineon: Illuminating design choices for prac- tical video-based virtual clothing try-on","venue":null,"work_id":"5b838fcc-b93a-4409-b6bb-37ff11f9c539","year":2021},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.693452Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:91f5f6fee0c7308fe3a518c46f3b18a1b80fe28b3996b4e7a4bcac4e45270aa0","observation_id":"9a7daf4c-5e7b-4183-b10e-be8099bf4f56","resolution":{"observed_at":"2026-08-07T14:54:58.740438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.535916Z","title":"Harivo: Harnessing text-to-image models for video generation","venue":null,"work_id":"01d96c36-8405-49e9-a7cc-0b5db516c52e","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.818012Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:066747b2e2a88c9191b1612b665a4cdfe6004fb0833caa9f9fa2ec7da0d19c40","observation_id":"0ca54db5-95b7-4b24-8d16-d2745c928a4e","resolution":{"observed_at":"2026-08-07T14:54:58.607167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.402721Z","title":"High-resolution virtual try-on with 9 misalignment and occlusion-handled conditions","venue":null,"work_id":"4f2243f1-e887-4b0d-b8bd-51c38a64e985","year":null},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:48.922055Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:b889572d4cf836811423df2ec31343472906e559656cdcc159746d57be6637ca","observation_id":"f4ca6d91-2f23-4e2d-a030-0d9a270a9627","resolution":{"observed_at":"2026-08-07T14:54:58.464320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.276242Z","title":"Virtual try-on with pose-garment keypoints guided inpaint- ing","venue":null,"work_id":"264afe81-b854-4812-87de-841c86b0f86f","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.022075Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:6cf681bb32ba47a7a4e987648f080d3bb161f146f2eb5bc7cc151b371ab5a4cd","observation_id":"6fec8036-6e76-4c5d-9eda-b15d1d524576","resolution":{"observed_at":"2026-08-07T14:54:58.326096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:58.067517Z","title":"Tsm: Temporal shift module for efficient video understanding","venue":null,"work_id":"2bdf3288-509c-4703-a116-ec6845af4d6c","year":2019},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.117348Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:073b58793542d2e1c3f955a56adca7460f80c38e89b96b3c2085ae328b6a845c","observation_id":"88776769-bb57-488d-93d6-026f896cf0e2","resolution":{"observed_at":"2026-08-07T14:54:58.183446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:57.758501Z","title":"Dress code: High- resolution multi-category virtual try-on","venue":null,"work_id":"90bbb1a4-b92c-469e-a649-4ea024d3aa0d","year":2022},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.242526Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:28793da5796819166f809af182dfad45f70f56670e1365df9b9295072236ba37","observation_id":"38feed65-42a6-44e7-bd43-499afeda61dd","resolution":{"observed_at":"2026-08-07T14:54:57.910541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:57.538886Z","title":"Ladi-vton: Latent diffusion textual-inversion enhanced virtual try-on","venue":null,"work_id":"59bf3f45-8c65-4eb6-b08c-ff8d5974d6ac","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.321947Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:c190c99c5de9c3d562b880cb8d72bb0b11b9556ef6580fcc071ac4568785e931","observation_id":"68c47574-cba1-48b4-80a0-6d07f16d67e2","resolution":{"observed_at":"2026-08-07T14:54:57.647706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:57.316462Z","title":"Deep generative design: integration of topology optimization and generative models.Journal of Mechanical Design, 141(11):111405, 2019","venue":null,"work_id":"b857be1a-50d3-495f-90fa-f9d0d8ff0331","year":2019},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.453122Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:a5fa995d4a223792a9971803141eef151f3cbe23eb0294da779dec4054738ce7","observation_id":"4de4040a-de50-43f2-a4fd-d34cae7e53f3","resolution":{"observed_at":"2026-08-07T14:54:57.419520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:57.057082Z","title":"To create what you tell: Generating videos from cap- tions","venue":null,"work_id":"a7c0b953-3faf-4581-81f4-bb3a38e2d370","year":2017},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.540075Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:89c33808882fd2aea14dd322511e8bb8e3469d10f288366bbed33b41abaf8b47","observation_id":"25a45578-95e9-4e5b-a8f0-8e995244b376","resolution":{"observed_at":"2026-08-07T14:54:57.163359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:49.646243Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.646243Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:3cb457256cf677c75eae6fe8b36985f3cac56367ddd73193d8bb3210341855d4","observation_id":"7b2c40d8-1255-4e69-9042-bae7ae2d920b","resolution":{"observed_at":"2026-08-07T14:54:49.646243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:56.848992Z","title":"You only look once: Unified, real-time object detection","venue":null,"work_id":"ae972652-e6b9-4413-9542-730403428e1a","year":2016},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.729763Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:ea1eec4a260a1375996f3ea727fc13ae0c6f0ed378be8bcc4cd772556d8d8ce9","observation_id":"69186465-d550-4281-92e4-0edcc51cf3a4","resolution":{"observed_at":"2026-08-07T14:54:56.932419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:49.831295Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.831295Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:77ae384a8c18694f420f0153a7ae9d18a9dd8237ec2f5d06fb024652edef58da","observation_id":"33d48cd0-6eed-46da-82f2-b7351b4a46c8","resolution":{"observed_at":"2026-08-07T14:54:49.831295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:56.588098Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"4e0ee66e-892a-4058-a71d-b5543f50e172","year":2015},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.916385Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:06900e3ba277461664c110e3070793971cc71cad67e073650d014ffb5f4a5bf8","observation_id":"e0d79e23-6b46-4b35-a950-cef3f6ddd93f","resolution":{"observed_at":"2026-08-07T14:54:56.708905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T14:54:49.992700Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:49.992700Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:2a0bd5963482b4828aeb2ddb30518a8095d0bb0371bf245657a9f2f88c6a4cf8","observation_id":"f6f13f02-e047-47f1-9bc1-b3697ec5f8a0","resolution":{"observed_at":"2026-08-07T14:54:49.992700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:56.333722Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"7eba7d31-8964-41b3-9f28-1fd92b8bdb39","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.089074Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:35b6a34587551b2bf0712bd118a57f35849f068e9fd03b590f486b8da250c93b","observation_id":"06cd2259-7e51-4969-aa88-8d07afa30f15","resolution":{"observed_at":"2026-08-07T14:54:56.446428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-07T14:54:50.188565Z","title":"To- wards accurate generative models of video: A new metric & challenges.arXiv preprint arXiv:1812.01717, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.188565Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:d9ae2d33104e43b83254249f80d4c837eeec2b2efa6a54b2301b96d0b5272399","observation_id":"7aa0f9d4-da9b-41db-8f70-be9496703546","resolution":{"observed_at":"2026-08-07T14:54:50.188565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:56.040528Z","title":"Improving virtual try-on with garment-focused diffusion models","venue":null,"work_id":"9050aaa7-ea0f-46d8-8624-edd53f089ccc","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.315062Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:5b89263d69bde40d5a48aa96e08dcf3389f68ba526f6c60b59c4c388b8872e55","observation_id":"2f8851f2-9509-4260-bf48-41994e048eaf","resolution":{"observed_at":"2026-08-07T14:54:56.160293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:55.733027Z","title":"Toward characteristic- preserving image-based virtual try-on network","venue":null,"work_id":"ac02752f-20e8-49d0-a054-62a03bb2c930","year":null},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.410820Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:8f31a5a82561fe39352f444e68b0cff21372940967b43971cb58d94388fe3455","observation_id":"c54b832d-fb9f-4b1b-a9bd-fc3640aeed15","resolution":{"observed_at":"2026-08-07T14:54:55.892979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:55.489874Z","title":"Gpd-vvto: Preserving garment details in video virtual try-on","venue":null,"work_id":"25034f70-35e4-4c57-8cca-0426f74549a5","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.494896Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:b3dbda6aa3c6ce81ffbfabce4c718a56fb4c56ea8fd1381374f82bd258f18874","observation_id":"22d0bf6f-5d8d-4eae-ac10-3d9b5ee2d470","resolution":{"observed_at":"2026-08-07T14:54:55.632481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:50.614250Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.614250Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:24eefd350b62d9d146b7e2f31f1d1b390b98ae817c1c38f162293de6834a0430","observation_id":"fcaad315-2e1b-4756-9c6d-70b49bb2fbea","resolution":{"observed_at":"2026-08-07T14:54:50.614250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:55.258340Z","title":"Gp- vton: Towards general purpose virtual try-on via collabora- tive local-flow global-parsing learning","venue":null,"work_id":"8ae7b3ae-ac6f-4901-835d-630625fba9d5","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.711497Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:21265f600f776faa55aa64686eac7e5f9052791126add71fe88fd687b9e0f33c","observation_id":"0a856155-5f9d-4b62-a5c9-0099f68dcbfe","resolution":{"observed_at":"2026-08-07T14:54:55.364261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:54.960429Z","title":"Simda: Simple diffusion adapter for efficient video generation","venue":null,"work_id":"96cb6f09-059b-4aa5-b9c7-dbcfd34de36f","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.801214Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:38dd45c58d7c48384971f23a38af45b353926df7f66011b617ce93ad6c1da641","observation_id":"109c476c-eef1-486b-8455-84dad1aae176","resolution":{"observed_at":"2026-08-07T14:54:55.109282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01779","last_updated":"2024-03-07T06:35:35Z","snapshot_observed_at":"2026-08-09T17:42:31.259033Z","submitted_at":"2024-03-04T07:17:44Z","title":"OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01779","snapshot_observed_at":"2026-08-07T14:54:50.886993Z","title":"Oot- diffusion: Outfitting fusion based latent diffusion for control- lable virtual try-on.arXiv preprint arXiv:2403.01779, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.886993Z"},"links":{"cited_paper":"/paper/2403.01779","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:ad8369041838a1794fb57c3279a66f1d6d0038cae5acf16037f4d6aae70fabbc","observation_id":"f4517e9c-2a6e-49fb-80fd-388fcd43b1da","resolution":{"observed_at":"2026-08-07T14:54:50.886993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:54.750462Z","title":"Tunnel try-on: Excavating spatial-temporal tunnels for high-quality virtual try-on in videos","venue":null,"work_id":"b69e5831-67e7-4adc-b209-7ce95fde2e8d","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:50.975725Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:14edc7b7945c1b77832d5b548c0216d4606a56c0bbc15657c38aa85e18bee4e2","observation_id":"baa57960-b80e-40fc-a029-37759917167d","resolution":{"observed_at":"2026-08-07T14:54:54.826624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:54.481562Z","title":"Texture-preserving diffusion models for high-fidelity virtual try-on","venue":null,"work_id":"dec5813f-33ff-4055-aa5a-af5d2eb8f02a","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.025480Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:ab09034ea1c29e425617cd539873947e58f007c3d708e1e6cfadd51dc40407f6","observation_id":"775de286-724e-4526-9566-6a81144033c7","resolution":{"observed_at":"2026-08-07T14:54:54.605790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:54.239760Z","title":"Effec- tive whole-body pose estimation with two-stages distillation","venue":null,"work_id":"a99c26e4-cd6f-4b71-ba87-262a5fb59750","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.134639Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:8e7c6e019ce31522b24632149356271a1e64c914a499e6859e2e609e4e6cdd13","observation_id":"b78a0a11-3dfd-4a44-a3d0-a137e7d6e5df","resolution":{"observed_at":"2026-08-07T14:54:54.359431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:53.999205Z","title":"Cat-dm: Controllable acceler- ated virtual try-on with diffusion model","venue":null,"work_id":"537b327c-1f87-4e13-9f37-30fb16b48ee8","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.253294Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:f4c0d250dfa821d54a0038efd7643ce7b25a55fd94cc743541c556063166da60","observation_id":"cd91391e-db9e-48f6-bc2b-6a18b8c95349","resolution":{"observed_at":"2026-08-07T14:54:54.117739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:51.340393Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.340393Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:c23fba0863c536438786176b082a0ff5162c6352fbb8236a5b73682a25cf69d4","observation_id":"7f57499d-5c1e-426c-b668-7e9e0db770a7","resolution":{"observed_at":"2026-08-07T14:54:51.340393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:53.717536Z","title":"Stableviton: Learning semantic correspondence with latent diffusion model for virtual try- on","venue":null,"work_id":"955e4601-3754-4235-ab94-3520f1e5cd57","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.434336Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:3d79609c37136b20de5ddb71fe7a105a21a8f10e0ac96d91376aea06ad485e1e","observation_id":"1a0465a8-32db-41d0-ac51-6db73938c4a0","resolution":{"observed_at":"2026-08-07T14:54:53.881785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00448","last_updated":"2024-11-20T09:40:14Z","snapshot_observed_at":"2026-08-09T22:43:59.631815Z","submitted_at":"2024-05-01T11:04:22Z","title":"MMTryon: Multi-Modal Multi-Reference Control for High-Quality Fashion Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00448","snapshot_observed_at":"2026-08-07T14:54:51.521925Z","title":"Mmtryon: Multi-modal multi-reference control for high-quality fashion generation.arXiv preprint arXiv:2405.00448, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.521925Z"},"links":{"cited_paper":"/paper/2405.00448","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:55788cf330031fab5c1c1d125d4b505f8d72974a12e72f8d7eb6d763d8e4d30f","observation_id":"92e7ae17-d028-4628-bf97-a344abc5a197","resolution":{"observed_at":"2026-08-07T14:54:51.521925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:53.396317Z","title":"Towards consistent video edit- ing with text-to-image diffusion models.Advances in Neural Information Processing Systems, 36:58508–58519, 2023","venue":null,"work_id":"4f25cdaf-b97c-456d-8d5a-5d091b9a6cdc","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.612754Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:eb0fc7b09af0900c71feb098e2779c3576963e5c80fc580b7964e71347412237","observation_id":"96cbf3e0-88b5-4e50-89ff-9e50d23e8966","resolution":{"observed_at":"2026-08-07T14:54:53.557733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:52.973128Z","title":"Trip: Temporal residual learning with image noise prior for image-to-video diffusion models","venue":null,"work_id":"75a6fd84-8910-4997-8358-2d840477cd48","year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.709442Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:287eb129174029ffeae1ef9c75168c7feb80329ff9e15c3f4c8960584941fe4c","observation_id":"7fa6eef5-d4ff-4d43-b115-292fe8f8c3e0","resolution":{"observed_at":"2026-08-07T14:54:53.161995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18326","last_updated":"2024-06-07T16:02:10Z","snapshot_observed_at":"2026-08-01T16:14:27.918920Z","submitted_at":"2024-05-28T16:21:03Z","title":"VITON-DiT: Learning In-the-Wild Video Try-On from Human Dance Videos via Diffusion Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18326","snapshot_observed_at":"2026-08-07T14:54:51.847344Z","title":"Viton-dit: Learning in-the-wild video try-on from human dance videos via diffusion transformers.arXiv preprint arXiv:2405.18326, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.847344Z"},"links":{"cited_paper":"/paper/2405.18326","citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:3a6edf202dec2f1431e9b79a031f084f7e0099bbaa14d91ad4dd3fad01b3374f","observation_id":"b20dd97d-d172-44ee-af09-7cb2415b047d","resolution":{"observed_at":"2026-08-07T14:54:51.847344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:52.625659Z","title":"Mv-ton: Memory-based video virtual try- on network","venue":null,"work_id":"14a92d7d-f720-4b93-867a-86f694423af5","year":2021},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:51.909725Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:b7cb529e0a02d42aa6404af8cb917fb2af8e4b75b01194c7b665037401bfc8bf","observation_id":"f63f0c49-7d52-4e0c-86dc-fb874af26bc5","resolution":{"observed_at":"2026-08-07T14:54:52.793047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:54:52.322101Z","title":"Tryondiffusion: A tale of two un- ets","venue":null,"work_id":"d5b92581-1cf4-4512-9241-4bf637a46bcb","year":2023},"citing_paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:54:52.001571Z"},"links":{"citing_paper":"/paper/2505.16980"},"observation_digest":"sha256:5229d2ec78dbc00ae4cd0594877542ae20c6ef66e978dd5a5f88c59d39745aa3","observation_id":"56f2bfef-d059-464a-be39-db347228c352","resolution":{"observed_at":"2026-08-07T14:54:52.465600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16980","last_updated":"2025-05-22T17:52:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T22:44:41.051852Z","submitted_at":"2025-05-22T17:52:34Z","title":"Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":47},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2505.16980."}