{"as_of":"2026-08-16T00:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebac2de2a79fe719558c62eb3ce68baa4fc26a012a9e58e3dd6995a9bc8d882a","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:54:58.686040Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05648/citation-record","integrity":"/paper/2608.05648/integrity","json":"/paper/2608.05648/citation-record.json","paper":"/paper/2608.05648"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.01392","last_updated":"2024-12-10T01:32:23Z","snapshot_observed_at":"2026-08-12T23:31:10.623373Z","submitted_at":"2024-07-01T15:43:25Z","title":"Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01392","snapshot_observed_at":"2026-08-08T04:54:58.639683Z","title":"Diffusion forcing: Next-token prediction meets full-sequence diffusion.arXiv preprint arXiv:2407.01392, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.639683Z"},"links":{"cited_paper":"/paper/2407.01392","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:3b9b4b36bf7cd8409c3085d42087f774319ab16652142d3cf4a7763be589dbe1","observation_id":"14876000-a03e-4650-b884-99611cdddd6e","resolution":{"observed_at":"2026-08-08T04:54:58.639683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-09T02:36:54.979612Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-08T04:54:58.647292Z","title":"Seedance 1.0: Exploring the boundaries of video generation models.arXiv preprint arXiv:2506.09113,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.647292Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:475c7558f0a9198c74aa8888ee5ff58c0f1d3162802cb87f96701887d54e521b","observation_id":"694d1c61-ed22-4361-b70e-37d4d2dc49a7","resolution":{"observed_at":"2026-08-08T04:54:58.647292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-08-13T15:06:04.699163Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-08T04:54:58.650815Z","title":"Ltx-2: Efficient joint audio-visual foundation model.arXiv preprint arXiv:2601.03233,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.650815Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:e3c578c85657e4109d48bdb3a4e29872a446a65af417bfd730f03f4afdbf3df9","observation_id":"d25c41a4-1df8-4587-af7b-1bf1dcea5886","resolution":{"observed_at":"2026-08-08T04:54:58.650815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-15T15:02:59.826496Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-08T04:54:58.658009Z","title":"Self forcing: Bridging the train- test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.658009Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:623a71b1b39ef8d5d48fa9378a5f9a4cdec8af07da357913c3631c61b92c4be3","observation_id":"f6fa9955-a18d-487f-8b09-5d0b3c84cff8","resolution":{"observed_at":"2026-08-08T04:54:58.658009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14468","last_updated":"2024-11-03T21:16:54Z","snapshot_observed_at":"2026-08-14T08:56:25.336901Z","submitted_at":"2024-03-21T15:15:00Z","title":"AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14468","snapshot_observed_at":"2026-08-08T04:54:58.661523Z","title":"Anyv2v: A tuning-free framework for any video-to-video editing tasks.arXiv preprint arXiv:2403.14468,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.661523Z"},"links":{"cited_paper":"/paper/2403.14468","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:16e59b76dd58039c90011167eda31612f065c917e96c667b4a5839c536a7f0f9","observation_id":"91ea9fcc-b054-465a-9e74-1cafd7393850","resolution":{"observed_at":"2026-08-08T04:54:58.661523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22940","last_updated":"2026-05-19T15:28:34Z","snapshot_observed_at":"2026-08-15T05:21:14.680981Z","submitted_at":"2025-11-28T07:30:10Z","title":"One-to-All Animation: Alignment-Free Character Animation and Image Pose Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22940","snapshot_observed_at":"2026-08-08T04:54:58.667551Z","title":"One-to-all animation: Alignment-free character animation and image pose transfer.arXiv preprint arXiv:2511.22940,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.667551Z"},"links":{"cited_paper":"/paper/2511.22940","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:d2ed9155cf74ac33e65b1573232a3dbb97680b9bfcd0bd8ad9cbdbeea7a055a5","observation_id":"9438765d-d80d-42f6-bb78-657360bcfe7b","resolution":{"observed_at":"2026-08-08T04:54:58.667551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-13T14:41:45.809481Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-08T04:54:58.670639Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.670639Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:e6ac1a364f1a5c76445fe3c441cd11621b6ea0f398f8042b9ebf41cd15c33894","observation_id":"99330b26-b962-428f-9d6e-ed4b9a17c12a","resolution":{"observed_at":"2026-08-08T04:54:58.670639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:54:58.677211Z","title":"Unianimate-dit: Human image animation with large-scale video diffusion transformer.arXiv preprint arXiv:2504.11289,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.677211Z"},"links":{"citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:b1b59ac3c0414da60be050c7e328336a4628795eb766703edb55d5ad3bc2e5da","observation_id":"75a0b93e-7885-4c3b-be6b-3beb7251ee16","resolution":{"observed_at":"2026-08-08T04:54:58.677211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.10804","last_updated":"2026-08-05T01:57:13Z","snapshot_observed_at":"2026-08-13T04:21:58.755533Z","submitted_at":"2026-06-09T12:49:34Z","title":"SCAIL-2: Unifying Controlled Character Animation with End-to-End In-Context Conditioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.10804","snapshot_observed_at":"2026-08-08T04:54:58.680041Z","title":"Scail-2: Unifying controlled character animation with end-to-end in-context conditioning.arXiv preprint arXiv:2606.10804, 2026a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.680041Z"},"links":{"cited_paper":"/paper/2606.10804","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:9eebf1691ead91b12bf618f5f58f140b394f9f567938f179b4b38e76e739a19c","observation_id":"f01d21ae-a35f-41aa-a0cd-21ca06c4ba1f","resolution":{"observed_at":"2026-08-08T04:54:58.680041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19320","last_updated":"2026-05-18T02:38:41Z","snapshot_observed_at":"2026-08-14T20:19:57.539830Z","submitted_at":"2025-11-24T17:15:55Z","title":"SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.19320","snapshot_observed_at":"2026-08-08T04:54:58.683114Z","title":"Steadydancer: Harmonized and coherent human image animation with first-frame preservation.arXiv preprint arXiv:2511.19320,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.683114Z"},"links":{"cited_paper":"/paper/2511.19320","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:931ee789bc0f7981741b8b0641de6cb237ee6d0e5f51cc913cc262275d132701","observation_id":"5bc91c86-05b6-4636-90b4-a3ee629a747e","resolution":{"observed_at":"2026-08-08T04:54:58.683114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12389","last_updated":"2025-01-21T18:59:31Z","snapshot_observed_at":"2026-08-14T03:10:15.912759Z","submitted_at":"2025-01-21T18:59:31Z","title":"Taming Teacher Forcing for Masked Autoregressive Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12389","snapshot_observed_at":"2026-08-08T04:54:58.686040Z","title":"Ni, and Heung-Yeung Shum","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.686040Z"},"links":{"cited_paper":"/paper/2501.12389","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:a857db39691b350efee29b0a4552321dfac212cae3d6d282ec02330164e700a5","observation_id":"ea3bcdc1-ed91-4ee5-aa03-278c26125255","resolution":{"observed_at":"2026-08-08T04:54:58.686040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T04:54:58.664692Z","title":"Dreamactor-m2: Universal character image animation via spatiotemporal in-context learning.arXiv preprint arXiv:2601.21716,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.664692Z"},"links":{"citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:e0a4340a5bce4a2745c5c4dbcae03f04f67353e329ed81fc67c1dce770807e0f","observation_id":"9eb543e8-d88d-4823-bb44-91125cb2dd70","resolution":{"observed_at":"2026-08-08T04:54:58.664692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-08T04:54:58.673754Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.673754Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:cdcce6bc1a2384862735b34cf5e6a585491eb6e22fffaa432c36453e5281a7e7","observation_id":"e7b16efa-ece7-4586-a970-745ac168715d","resolution":{"observed_at":"2026-08-08T04:54:58.673754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-15T11:14:14.860047Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00830","snapshot_observed_at":"2026-08-08T04:54:58.643717Z","title":"Skyreels-audio: Omni audio-conditioned talking portraits in video diffusion transformers.arXiv preprint arXiv:2506.00830,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.643717Z"},"links":{"cited_paper":"/paper/2506.00830","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:ad5f125e6ede9e9eeb6b161ddc1767617d61255b974371884940b1bb5b82db2a","observation_id":"74bb284c-54b8-47aa-99d2-c80300e66aec","resolution":{"observed_at":"2026-08-08T04:54:58.643717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-15T23:24:13.384254Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-08T04:54:58.654243Z","title":"Animate anyone 2: High-fidelity character image animation with environment affordance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-08T04:54:58.654243Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2608.05648"},"observation_digest":"sha256:af517cfc398ebb9f14c942ab511cbd4a3fe9e4a96eea4f193c3ba7008d72d6e1","observation_id":"7b68b13c-0de6-45ee-807e-dc1472fd2363","resolution":{"observed_at":"2026-08-08T04:54:58.654243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05648","last_updated":"2026-08-06T06:46:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T05:01:24.809733Z","submitted_at":"2026-08-06T06:46:35Z","title":"Vorch-IR: Long-Form Unified Multimodal Identity Replacement Video Generation"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2608.05648."}