{"as_of":"2026-08-10T00:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d52f2baccfb393319f5aa97fe022d3ceeb3284f6d8049a8023a54265b89ef39","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:40:31.874908Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:30:32.966807Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T06:35:29.300393Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-08-07T05:30:32.966807Z","title":"Liang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07848","last_updated":"2025-06-09T15:11:09Z","snapshot_observed_at":"2026-08-08T19:43:46.912375Z","submitted_at":"2025-06-09T15:11:09Z","title":"PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:32.966807Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2506.07848"},"observation_digest":"sha256:3da8fecbcf9434f93e7ab460fba7b8a432ae7dcf476ec881016965e71593c7bc","observation_id":"20c8f669-c750-4943-8128-6c68e642efac","resolution":{"observed_at":"2026-08-07T05:30:32.966807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-08-05T12:27:35.520877Z","title":"Omniv2v: Versatile video generation and edit- ing via dynamic content manipulation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01596","last_updated":"2025-09-01T16:29:39Z","snapshot_observed_at":"2026-08-08T15:15:29.549875Z","submitted_at":"2025-09-01T16:29:39Z","title":"O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T12:27:35.520877Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2509.01596"},"observation_digest":"sha256:4dcbe6cf553802b721464c5cf61920e44601ba542214c2c5f969ef3262132266","observation_id":"4e7ba915-4565-4676-8d16-042132cbc5a0","resolution":{"observed_at":"2026-08-05T12:27:35.520877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-08-03T15:28:55.500256Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation.arXiv preprint arXiv:2506.01801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17796","last_updated":"2026-06-24T08:52:20Z","snapshot_observed_at":"2026-08-06T07:44:38.380189Z","submitted_at":"2025-12-18T18:59:18Z","title":"CustomX: Unified Character, Action, and Scene Customization in Video World Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T15:28:55.500256Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2512.17796"},"observation_digest":"sha256:4c9a2d0e8c0a86727f4767dae090505e7bd2975a4b4fbe0dec00fb6191a8ad7d","observation_id":"8872f1c4-d34b-45cb-ab03-33ed9ffecb63","resolution":{"observed_at":"2026-08-03T15:28:55.500256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2604.06339","last_updated":"2026-04-07T18:17:05Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T18:17:05Z","title":"Evolution of Video Generative Foundations","version":1},"reference_index":275,"source":"pdf_text","source_observed_at":"2026-05-10T18:41:38.616611Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2604.06339"},"observation_digest":"sha256:d346c1699ca593a8694913235d7e1d427fc0d882626fc66c02117ef6ac20ab23","observation_id":"5681b480-4cf6-4d5b-b0b2-124a1b57784d","resolution":{"observed_at":"2026-05-11T00:05:51.648033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2604.08646","last_updated":"2026-04-09T17:59:02Z","snapshot_observed_at":"2026-07-06T22:57:40.773778Z","submitted_at":"2026-04-09T17:59:02Z","title":"InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:59.791758Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2604.08646"},"observation_digest":"sha256:69f1158bc37c16713674a4e9d7beeef6dbda6253e7baeff89d6f9ff7c6532b71","observation_id":"470c289e-e61f-42f5-8227-fbf222e3e6fb","resolution":{"observed_at":"2026-05-11T06:25:57.639283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2605.04569","last_updated":"2026-05-28T14:50:27Z","snapshot_observed_at":"2026-07-06T23:17:18.486586Z","submitted_at":"2026-05-06T07:15:29Z","title":"LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-01T00:24:30.573122Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2605.04569"},"observation_digest":"sha256:f58a30a79595dbe9bc46f1aeeca37479e38593771f36a54476fdebc60d1d6e55","observation_id":"c8f6d9d7-f7ca-405d-a28a-027464cc43db","resolution":{"observed_at":"2026-07-01T00:25:09.369993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:0acc9b6653c94bfc4ca0031e6440e4aff246f08561d4aede8a6c7e481736d0fb","observation_id":"67b5b5c5-efb3-41f8-ad5a-d60d8c1e96e2","resolution":{"observed_at":"2026-05-20T15:08:24.942907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2605.25193","last_updated":"2026-05-29T13:55:41Z","snapshot_observed_at":"2026-08-02T06:28:29.008131Z","submitted_at":"2026-05-24T17:50:45Z","title":"SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T12:07:44.914337Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2605.25193"},"observation_digest":"sha256:e9cd59ce65c116e3dbd4869a7ba53ff14de9341a0cd54e510a85a0ff1a058ee4","observation_id":"8e746498-766a-4f35-a272-b47158cf580a","resolution":{"observed_at":"2026-06-30T12:34:39.531973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T06:00:24.487104Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:5f33725478afd563fc232d423a82bcb43f17e669ef76406c209f20f4931f9bb1","observation_id":"cf881cc6-12b4-4b8f-9c42-462b4d6d4d73","resolution":{"observed_at":"2026-06-30T06:04:21.464845Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"cited_work":{"arxiv_id":"2506.01801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01801","snapshot_observed_at":"2026-07-01T06:35:29.300393Z","title":"Omniv2v: Versatile video generation and editing via dynamic content manipulation","venue":null,"work_id":"8b051987-70a4-457e-bf17-cc4efe2053ef","year":2025},"citing_paper":{"arxiv_id":"2606.30599","last_updated":"2026-06-30T16:06:04Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:38:15Z","title":"Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T06:35:16.951243Z"},"links":{"cited_paper":"/paper/2506.01801","citing_paper":"/paper/2606.30599"},"observation_digest":"sha256:336bd7e4ec3c0ba39f8762de79072856eb9aed52587f6f60b2c61702f90486b5","observation_id":"3e8ba910-cbed-46aa-9e35-7156500d3ec4","resolution":{"observed_at":"2026-07-01T06:35:29.302311Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01801/citation-record","integrity":"/paper/2506.01801/integrity","json":"/paper/2506.01801/citation-record.json","paper":"/paper/2506.01801"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T11:38:50.713973Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:50.713973Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:55f2edb9a7bcdf2d145c52460809c751848a08b732b34b47f4426e0da7c18b92","observation_id":"118e931b-7b55-40f0-a71b-46f09e0065cd","resolution":{"observed_at":"2026-08-07T11:38:50.713973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-08T15:14:24.281572Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-07T11:38:52.703579Z","title":"Bar-Tal, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:38:52.703579Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:771c9c55d0c6db060b87b86e24c43ceaf81a13a940ca571172ada476c9add0e7","observation_id":"d1ccd316-5f7c-4e7f-9ff8-f0c1365a7b85","resolution":{"observed_at":"2026-08-07T11:38:52.703579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05639","last_updated":"2025-04-09T02:05:33Z","snapshot_observed_at":"2026-08-07T17:21:31.749191Z","submitted_at":"2025-03-07T17:59:46Z","title":"VideoPainter: Any-length Video Inpainting and Editing with Plug-and-Play Context Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05639","snapshot_observed_at":"2026-08-07T11:39:46.169619Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.169619Z"},"links":{"cited_paper":"/paper/2503.05639","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:408f7897e892c4658b2c74657e53e83327a114afd7d0689787b2e9a90b61f230","observation_id":"369e0163-888f-46ca-bad8-86e7c402e31b","resolution":{"observed_at":"2026-08-07T11:39:46.169619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T11:39:46.291047Z","title":"Blattmann, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.291047Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:e82852ce1602e7f90b140ae014616a1d020d2b9dffe6f24b4d317d68c1decb31","observation_id":"273f6702-3d5c-4f94-9a9b-37922d42db71","resolution":{"observed_at":"2026-08-07T11:39:46.291047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.263833Z","title":"Blattmann, R","venue":null,"work_id":"8a5d10f4-6759-4d10-a9c4-6709e5d8bd4f","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.384254Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:2da746baf7b81eb95d2ef0846eb1280fc41f442cf3c65b9c8949154b4334e965","observation_id":"b131cd8c-b9b8-40cd-9441-e53a21641756","resolution":{"observed_at":"2026-08-07T11:40:59.331274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.492609Z","title":"Brooks, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.492609Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:ddb4e151c6ec2ebac08554ed8600033b9fe5e1b63bddc67ba14169d28de8ca7c","observation_id":"0a251be9-ab9a-4f49-9bb1-904477396257","resolution":{"observed_at":"2026-08-07T11:39:46.492609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.561900Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.561900Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:2dadf5b714d47257571d94cb14246082055a4311274803397d078209d5f9b97b","observation_id":"65b19317-d8bf-4063-a9a9-001ce7c454f8","resolution":{"observed_at":"2026-08-07T11:39:46.561900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.651622Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.651622Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:6d82c048aff5e9b4c9d68169137215229a4f28980fcf8344708b46e4df4303b8","observation_id":"017b8fe5-3fc4-4341-bb79-50f1404c0b21","resolution":{"observed_at":"2026-08-07T11:39:46.651622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.218862Z","title":null,"venue":null,"work_id":"245e98c1-1dc1-4851-b5d2-214aff91ace8","year":2020},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.738533Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:9b1c96ede529212e609fba0203fc2b52d5620dad6727c8bdc554be2d97867345","observation_id":"53a94e85-3a06-4e21-bcaf-6b2dad1ffaf4","resolution":{"observed_at":"2026-08-07T11:40:59.222657Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:46.816206Z","title":"Esser, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.816206Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:7c6d30395e88f7490803e94acb203e8ef1675f5e92e739e31cdaec891ffa0562","observation_id":"2ff6179d-1e51-4bbe-a239-3931b31d093e","resolution":{"observed_at":"2026-08-07T11:39:46.816206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.128319Z","title":null,"venue":null,"work_id":"e6446861-f389-4cd3-88ae-2df89d15330e","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.885368Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:ffaa4d2d7a9b67c2f7d525583add9dc6317f737fb15fc7dc58a208361b3c7279","observation_id":"c4270567-faa5-4b17-976a-050e12afd5fc","resolution":{"observed_at":"2026-08-07T11:40:59.183535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11794","last_updated":"2024-05-28T04:08:09Z","snapshot_observed_at":"2026-07-06T18:16:33.179338Z","submitted_at":"2024-05-20T05:28:22Z","title":"ViViD: Video Virtual Try-on using Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11794","snapshot_observed_at":"2026-08-07T11:39:46.936456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.936456Z"},"links":{"cited_paper":"/paper/2405.11794","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:06dffacbe65f10eb92006770155625a690e165b97ce3a94c271587999a29d2ac","observation_id":"f0e007ef-3e18-4c18-bf7d-31edf6cdf2eb","resolution":{"observed_at":"2026-08-07T11:39:46.936456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:59.001248Z","title":null,"venue":null,"work_id":"edaee0cf-38d4-438b-a3a4-04ef23fa988f","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:46.961143Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:552d5d11b86b7066995fa18e3e2cc70e13f0ddb88ffd3740228f29f6bb3c3701","observation_id":"2c58ad35-fe9f-490a-8b50-8a01c4360334","resolution":{"observed_at":"2026-08-07T11:40:59.082372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T11:39:47.018924Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.018924Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:c4490e026189f7c7575660bc98e3a84159c5d42146dd8174bc3ac5f40f4e85d8","observation_id":"46d41ed7-ab5a-4acb-853d-a5cab9de5ad9","resolution":{"observed_at":"2026-08-07T11:39:47.018924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-07T19:06:02.627634Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T11:39:47.248333Z","title":"Gupta, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.248333Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:e968c4ea85021ea434139b294b803c1a9d18f953102d27d559b32f9a081ea91e","observation_id":"de3c8e32-8ac4-447b-9930-3376b4452548","resolution":{"observed_at":"2026-08-07T11:39:47.248333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:47.379582Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.379582Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:218e365a3885c5c7a88b968fc6cfa2c2932b4e234120a5f062c71b287c876931","observation_id":"043d3af8-7c36-4cbe-a6f8-669d1faabe60","resolution":{"observed_at":"2026-08-07T11:39:47.379582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-07-06T13:15:58.303738Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-07T11:39:47.455532Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.455532Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:5959e3a3149206e9aaf04f763895af69ec81eab2c0417971a6538ef0307262da","observation_id":"7c404731-ca62-48ce-bd9a-78f2f0caee08","resolution":{"observed_at":"2026-08-07T11:39:47.455532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.818137Z","title":null,"venue":null,"work_id":"df36f3c1-3592-4ed5-8bdf-60f24306a8f7","year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.565926Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:ff05fde830309450a6fe7001593aaedb65f25d78d39c8639b707f625eb39a4f3","observation_id":"2978ab2a-659d-4d99-a578-7858e0bc6aaf","resolution":{"observed_at":"2026-08-07T11:40:58.900370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06145","last_updated":"2025-02-10T04:20:11Z","snapshot_observed_at":"2026-08-09T19:19:20.156034Z","submitted_at":"2025-02-10T04:20:11Z","title":"Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06145","snapshot_observed_at":"2026-08-07T11:39:48.879677Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:48.879677Z"},"links":{"cited_paper":"/paper/2502.06145","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:05291f0715ee39a0586e5df8235ed3344fda64d837dd2efebde6b9a33c9aeccc","observation_id":"5f249c22-f896-44d5-b3c3-68efe74d7b8b","resolution":{"observed_at":"2026-08-07T11:39:48.879677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-08T15:15:48.227139Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04512","snapshot_observed_at":"2026-08-07T11:39:51.666724Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:51.666724Z"},"links":{"cited_paper":"/paper/2505.04512","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:8508f3863ad8a79f79bba8e5e265ea54542efb3c4492b2823f8ed6c3dbaa865b","observation_id":"abfbb6ad-57e0-46c4-8e59-66bedea81e69","resolution":{"observed_at":"2026-08-07T11:39:51.666724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:51.788811Z","title":"Huang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:51.788811Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:37f5481a0800d9d739681ed86c7e00c7ff50b3f052993526adedf5fa93441764","observation_id":"135480c1-fb70-4a49-8174-db276cabd1c7","resolution":{"observed_at":"2026-08-07T11:39:51.788811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.668102Z","title":"Jiang, T","venue":null,"work_id":"93bca13d-a5c2-47d5-b690-323282fa1113","year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:51.880715Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:d7a5dd938e2e85bb48d86640c7fba100c551b85a2db6418e20471f72d95c92f2","observation_id":"9b714a01-bde1-4c75-98d5-4ece07a81d51","resolution":{"observed_at":"2026-08-07T11:40:58.725322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-08-07T11:39:51.997464Z","title":"Jiang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:51.997464Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:d7b6d4e2ba24a951ad14c0c0c332d33152c993ed29f5d03c319f83edc30f45f9","observation_id":"87222aac-cfb4-4195-88ef-6ef4c99a94a0","resolution":{"observed_at":"2026-08-07T11:39:51.997464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.099616Z","title":"Keling.https://klingai.com/cn/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.099616Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:3103f3f9e33b27bf12809a716980935baa1c57413d4fcef4f7d8d9626b1a7337","observation_id":"daabe0cb-355d-4ddc-9e55-566cb06f2ae1","resolution":{"observed_at":"2026-08-07T11:39:52.099616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17725","last_updated":"2024-10-23T09:55:22Z","snapshot_observed_at":"2026-07-06T19:38:22.461739Z","submitted_at":"2024-10-23T09:55:22Z","title":"YOLOv11: An Overview of the Key Architectural Enhancements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17725","snapshot_observed_at":"2026-08-07T11:39:52.178026Z","title":"Khanam and M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.178026Z"},"links":{"cited_paper":"/paper/2410.17725","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:a7d4ced9f8f547274317aa2ec522391907bfc8aa5465276de8721f3f272d57b3","observation_id":"4bdbf48b-7a03-45a4-8b29-75b3befe61cf","resolution":{"observed_at":"2026-08-07T11:39:52.178026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.652369Z","title":null,"venue":null,"work_id":"de16211e-4a86-4bb8-ad39-d6ab952e6dc2","year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.259092Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:4cd365d4a715af8b848b7a5c33ef2c3fb93cdf4a608549293d01f3b85e00a9de","observation_id":"0dd5a1b9-c876-4b58-826a-c0be936d2c04","resolution":{"observed_at":"2026-08-07T11:40:58.656141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-07T11:39:52.398694Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.398694Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:dc365891b0b0c7d7860fd0082c9ca4965e9470d197cc0abcfc5a388bd881ed6c","observation_id":"254eb6c9-1218-44b9-8317-8832ccbc0013","resolution":{"observed_at":"2026-08-07T11:39:52.398694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.511971Z","title":null,"venue":null,"work_id":"1bd79da7-7d35-4700-b671-350cda5faf0f","year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.463475Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:8a85b581e22a3d8f5b6b018bb9d68dd67a16a9bfe1f25afe7120a618cbd76ca1","observation_id":"c8969fd9-064c-4d75-a100-8c1fa86f3c66","resolution":{"observed_at":"2026-08-07T11:40:58.622142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.359415Z","title":null,"venue":null,"work_id":"e4195ef6-dc35-498c-ad2c-17bc0ed0c4a9","year":2018},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.553528Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:767ffb832ad80fe085e25b3b512984446ccec98459f8be38a0257f2f5b68a735","observation_id":"3ffa3133-df5b-4128-ae5c-48f61cbca3dd","resolution":{"observed_at":"2026-08-07T11:40:58.439485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-07T11:39:52.770522Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.770522Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:21d42a4905c56acb246b0a435e80ac3a9f8f1087456cb2d47e14b1bcc26ba658","observation_id":"33884d4d-d15d-40be-8aad-eb28daf44fed","resolution":{"observed_at":"2026-08-07T11:39:52.770522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:39:52.921540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.921540Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:4e631d4e846d88c4a70ca67b290c9873a6baf9eded89eb70a2363819d3fc21fe","observation_id":"c29bffa4-9ea6-43fb-b5ce-b07a2e34dc90","resolution":{"observed_at":"2026-08-07T11:39:52.921540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19383","last_updated":"2025-03-25T06:24:37Z","snapshot_observed_at":"2026-08-07T16:39:14.612333Z","submitted_at":"2025-03-25T06:24:37Z","title":"MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation","version":1},"cited_work":{"arxiv_id":"2503.19383","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.19383","snapshot_observed_at":"2026-08-07T11:40:35.933526Z","title":"MVPortrait: Text-Guided Motion and Emotion Control for Multi-view Vivid Portrait Animation","venue":"cs.CV","work_id":"d1d98109-4d69-4804-bfb0-3af6e0adbc31","year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:53.017722Z"},"links":{"cited_paper":"/paper/2503.19383","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:ff4f7b1b9402d937dd25a9f8becae3302a9ffa730b24970111b891528db2c970","observation_id":"507c8c48-2333-401e-93f7-ae2275d9fd41","resolution":{"observed_at":"2026-08-07T11:40:35.987741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T11:39:53.102556Z","title":"Lipman, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:53.102556Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:313fd92ff6bb3b748d960a2b93a22cac0135d49a82ae8f08998f617558bfdda5","observation_id":"af04649c-2d63-4df1-a95f-ad68a01094ee","resolution":{"observed_at":"2026-08-07T11:39:53.102556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.226088Z","title":null,"venue":null,"work_id":"504f66ba-e49f-437d-a0ea-f86d8c84fbcb","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:53.212280Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:5278410fba403b79398ceb67f1f0adf22d7d5bf348f4f9895c913ad8824dfb9c","observation_id":"2f84dc5d-c809-4419-a220-05d8ce4b132b","resolution":{"observed_at":"2026-08-07T11:40:58.288767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-07T11:39:53.374230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:53.374230Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:041d573b7260352b42b23619d36ba0d431cebcfa2d595c8d7c075e2901973514","observation_id":"5e3e52df-bea3-469b-bfce-a9dc0297ae46","resolution":{"observed_at":"2026-08-07T11:39:53.374230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16160","last_updated":"2025-06-11T08:28:01Z","snapshot_observed_at":"2026-08-07T23:57:27.127966Z","submitted_at":"2024-09-24T15:00:07Z","title":"MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16160","snapshot_observed_at":"2026-08-07T11:40:07.102074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:07.102074Z"},"links":{"cited_paper":"/paper/2409.16160","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:334381e461b472dad953995f4d96faaec0e546ab1a0d313a219f23b302790bb4","observation_id":"d2e6ccb4-7e08-4a0c-b22a-7d4a18dfcda8","resolution":{"observed_at":"2026-08-07T11:40:07.102074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:08.043161Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:08.043161Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:be985e7778c3fff5706ef57173832c7f9a348e7a7d83f9fbaa4dc1659f8b4558","observation_id":"aee284fc-764a-4fcf-b507-8a6035433046","resolution":{"observed_at":"2026-08-07T11:40:08.043161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T11:40:09.312258Z","title":"Oquab, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.312258Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:749b6db24d3e5ade092bdbab67c9ba83c6a598962cf768ba31cba3e7e0ac02ad","observation_id":"22c53d45-5756-4028-8d2f-55faf0b5ebf6","resolution":{"observed_at":"2026-08-07T11:40:09.312258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.642125Z","title":"Pika.https://pika.art/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.642125Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:24bd33e865b3afc35d829bee714f249154d5a356ded4d15c2e35b71db60bf4ba","observation_id":"fc0562f5-b23b-4403-b66e-f9683c845348","resolution":{"observed_at":"2026-08-07T11:40:09.642125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.108049Z","title":"Pyscenedetect","venue":null,"work_id":"e41447df-65c5-4917-898a-7097bb4d69ac","year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.776994Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:81c24172c0e492dae331cb200b8a43bb9b699856caba17aef651740e3ff95949","observation_id":"628a2472-bac6-479f-a183-fada951525a1","resolution":{"observed_at":"2026-08-07T11:40:58.149094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.867624Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.867624Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:507b5208111c3c452de4d611e1fcfe016e5c86cf2b7db45fa1908af2ac0f1770","observation_id":"e3d9156d-72e9-4d36-aa74-379792cdb66d","resolution":{"observed_at":"2026-08-07T11:40:09.867624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.899621Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.899621Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:0a8359c9e61863ca6a676ba5d715b265f2bc8edf568315f4bbdd904e37008552","observation_id":"a635f3c3-408b-499f-8519-c51bcfc6d9f2","resolution":{"observed_at":"2026-08-07T11:40:09.899621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:09.918084Z","title":"Rombach, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.918084Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:61690f141d92b638a23c5f4b8e2d181ea794fc2719bb256ddbcbab917c919791","observation_id":"f26cca92-6327-4e63-93fd-87ad2797a674","resolution":{"observed_at":"2026-08-07T11:40:09.918084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-07T11:40:09.979438Z","title":"Singer, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.979438Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:8e4ee67299ce41b166634bc638b57e9615351869f20fc6ecf1f5c01c23c7bb99","observation_id":"924e02b0-5724-467d-8937-45581b8d1034","resolution":{"observed_at":"2026-08-07T11:40:09.979438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01427","last_updated":"2025-05-28T08:03:56Z","snapshot_observed_at":"2026-08-04T03:35:06.570209Z","submitted_at":"2025-01-02T18:59:54Z","title":"VideoAnydoor: High-fidelity Video Object Insertion with Precise Motion Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01427","snapshot_observed_at":"2026-08-07T11:40:11.028853Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.028853Z"},"links":{"cited_paper":"/paper/2501.01427","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:a5c7451a85d7c3799d94b9cc11bb4417c749db00e0f9b400e1e72863f5a91793","observation_id":"34f7f8fc-495d-4c0e-811b-700ac56c281a","resolution":{"observed_at":"2026-08-07T11:40:11.028853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:58.055662Z","title":"Villegas, M","venue":null,"work_id":"0a94342d-c581-4ed8-afdf-cc813a794e71","year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.633824Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:1864b29855351fd637de11f223347fca1da41cfff981db7d10a6f49eb3a2116c","observation_id":"655fd43f-fc7a-4b3d-9f0d-dee7dbe678c0","resolution":{"observed_at":"2026-08-07T11:40:58.072322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-07T11:40:11.767749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.767749Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:73c3342e91bb69b60da0f0756ce668d0e2dd6f95a0692cc9b13d643bbd2156a1","observation_id":"420ca67a-4402-400b-b631-4ae1264d4107","resolution":{"observed_at":"2026-08-07T11:40:11.767749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-07T17:54:54.749604Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-07T11:40:11.846937Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.846937Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:0b172f176a13a0a516ce722d576ff2b0f88386cca4d420453a73c179bc428c2a","observation_id":"6e03481c-974c-4b65-bfcb-364df1c98978","resolution":{"observed_at":"2026-08-07T11:40:11.846937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08260","last_updated":"2025-04-26T17:58:24Z","snapshot_observed_at":"2026-08-01T11:16:30.883699Z","submitted_at":"2024-10-10T17:57:49Z","title":"Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08260","snapshot_observed_at":"2026-08-07T11:40:11.909797Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.909797Z"},"links":{"cited_paper":"/paper/2410.08260","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:da948e57dadf089bc26e9d9617e7778540bb4aba2e57d5c0f197dbc6b8b912e9","observation_id":"1595744d-92b5-4be1-99ba-f97e31772f05","resolution":{"observed_at":"2026-08-07T11:40:11.909797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:57.910614Z","title":null,"venue":null,"work_id":"24240696-b6e8-468d-adbc-18d199d20749","year":2020},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.969221Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:fa476b0be1cb12f91be62c1f267731b711937bf5c45c70a8d3cbfd5fd7d4d6f0","observation_id":"95db9763-8ecf-4518-80e2-9b2a46a94671","resolution":{"observed_at":"2026-08-07T11:40:57.962147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:57.831882Z","title":null,"venue":null,"work_id":"564c2e1e-cfc0-4a99-9b2a-a95e9addfa3f","year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:11.986258Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:305e2a504356c6673e83376a64a8fd957e3efcce770e17c0e5a1715fa5d8aad4","observation_id":"961ed66a-9cb7-4263-8e6e-6f970910c7c9","resolution":{"observed_at":"2026-08-07T11:40:57.895386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18860","last_updated":"2025-03-25T10:59:23Z","snapshot_observed_at":"2026-08-07T16:40:41.195023Z","submitted_at":"2025-03-24T16:35:41Z","title":"HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation","version":2},"cited_work":{"arxiv_id":"2503.18860","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18860","snapshot_observed_at":"2026-08-07T11:40:33.597539Z","title":"HunyuanPortrait: Implicit Condition Control for Enhanced Portrait Animation","venue":"cs.CV","work_id":"bb1cba0a-6fa6-4a13-98d7-d7bee07cff9b","year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.003828Z"},"links":{"cited_paper":"/paper/2503.18860","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:fea866c731b762a34abd6e2ef49ab8a235ffe197701855b50d4bd654c99a123a","observation_id":"88271dac-aac5-4401-9931-fdd0eaf71599","resolution":{"observed_at":"2026-08-07T11:40:35.687009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:57.758349Z","title":null,"venue":null,"work_id":"a008c0a9-3ce1-4213-a8a9-e3542768f7c6","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.025074Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:d8d28b6e4f4522cb64d2cf4df1455d875de978138d80b24147ec312a365abc33","observation_id":"ca557571-03bc-41a9-9ce7-7c4b3f9b29ae","resolution":{"observed_at":"2026-08-07T11:40:57.792674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-07T11:40:12.048058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.048058Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:56a5ef04905992dfc4ccbb2907d32276fb413ae29ee1ecf70fc7882068368ce2","observation_id":"d4c70710-7af1-497b-a1e7-5ffd6e0a2380","resolution":{"observed_at":"2026-08-07T11:40:12.048058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:57.518421Z","title":"Zhang, A","venue":null,"work_id":"c2611dad-2145-48e8-abfc-87b6280c8360","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.074349Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:3726d621b5aa92371a08f43d3011f84e0e6c48747d263e35ac7f8ac9da0b4e93","observation_id":"52d73eb0-b136-4b9a-b463-5ffde50861df","resolution":{"observed_at":"2026-08-07T11:40:57.703042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-07T11:40:12.106355Z","title":"Zhang, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.106355Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:c48c4bf226e27311ef7a3fa6e87db8142f39476b802d8f722203a3448da8dfe1","observation_id":"22ca4c58-c925-4ad7-9c4a-9119b1d304ca","resolution":{"observed_at":"2026-08-07T11:40:12.106355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:55.997925Z","title":"Zhang, C","venue":null,"work_id":"9db9043f-cecb-406a-9262-7a36d177e235","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.139699Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:024c04281d6d50d1ef4be624832b3adc6703ee0f2a22ba0b5b47105afac9842e","observation_id":"0297fb1e-e192-4a59-8e91-0f1fbaeafa4c","resolution":{"observed_at":"2026-08-07T11:40:56.046284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19680","last_updated":"2025-06-27T10:06:13Z","snapshot_observed_at":"2026-08-09T19:19:40.842650Z","submitted_at":"2024-06-28T06:40:53Z","title":"MimicMotion: High-Quality Human Motion Video Generation with Confidence-aware Pose Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19680","snapshot_observed_at":"2026-08-07T11:40:12.195591Z","title":"Zhang, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.195591Z"},"links":{"cited_paper":"/paper/2406.19680","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:731cbce9ba9c4c45320652b2d90885c15859d26610bed8452055413830c01b40","observation_id":"ec0c74fc-097e-4a40-918a-b7baa11169e7","resolution":{"observed_at":"2026-08-07T11:40:12.195591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:55.918026Z","title":"Zhong, Z","venue":null,"work_id":"ed22921f-4a16-49dc-86f0-3c64d776a9ab","year":2021},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:12.252910Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:98de5d6736efc24397445161ee1011c7c2d5e66e7897309ae115750547114fc3","observation_id":"cf7212b6-0ebb-46b9-90a2-3e8cea87f947","resolution":{"observed_at":"2026-08-07T11:40:55.928414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-07T11:40:21.608328Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:21.608328Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:cfa3b591d76368c01fb666a2fa5e6c85cad90d5c775471d8e2d00df733f67293","observation_id":"f4fecdb6-77b0-4a95-946a-eb663aba154f","resolution":{"observed_at":"2026-08-07T11:40:21.608328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:55.547548Z","title":null,"venue":null,"work_id":"98bbb274-19ea-4505-98d0-1272e4a821fd","year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.219564Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:03b030596ad4cb045f56109c702c9fa60a107d5a2a939225cbcf4006f97d5c93","observation_id":"3890b32b-11d6-4bb6-975d-7fa1a504316c","resolution":{"observed_at":"2026-08-07T11:40:55.874659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15458","last_updated":"2024-10-20T17:51:35Z","snapshot_observed_at":"2026-08-09T19:18:25.696349Z","submitted_at":"2024-10-20T17:51:35Z","title":"Allegro: Open the Black Box of Commercial-Level Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15458","snapshot_observed_at":"2026-08-07T11:40:23.559628Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.559628Z"},"links":{"cited_paper":"/paper/2410.15458","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:bd19bdff3c96a7bec76ad8ac695d44710e5c262d02259e58edf2ee17beaeeca4","observation_id":"7a15593f-66ba-4175-a21e-83154ffc2f23","resolution":{"observed_at":"2026-08-07T11:40:23.559628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:53.232090Z","title":null,"venue":null,"work_id":"2ad75f96-7292-4b77-bf40-8e703d2ff353","year":2024},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:23.793851Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:017fe93a434be30256ac579ac0cb4dbc085d02db6ca8e0a2efac62725581406c","observation_id":"afedbd37-be40-4ad8-9d3e-8e30ff17daff","resolution":{"observed_at":"2026-08-07T11:40:54.885897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06268","last_updated":"2025-03-08T16:27:53Z","snapshot_observed_at":"2026-08-07T17:20:02.617612Z","submitted_at":"2025-03-08T16:27:53Z","title":"Get In Video: Add Anything You Want to the Video","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06268","snapshot_observed_at":"2026-08-07T11:40:30.826032Z","title":"Zhuang, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:30.826032Z"},"links":{"cited_paper":"/paper/2503.06268","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:e7bb293576f88e611621f65e3c93b46c15091c65ecd06ca998ab9d994d8d1354","observation_id":"8a7ef253-cb3c-4252-a083-01c106a8c15d","resolution":{"observed_at":"2026-08-07T11:40:30.826032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:40:36.229365Z","title":null,"venue":null,"work_id":"6ff47480-d093-4391-8622-07ebb873c44e","year":2025},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:31.874908Z"},"links":{"citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:65e40c48e5d53a28d5b3ddee8207f495fd9a967f6a32772cbb8e648a7da0481c","observation_id":"a0a45e4a-8316-448e-bbdc-acbb54f15e93","resolution":{"observed_at":"2026-08-07T11:40:46.567758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T20:24:18.281655Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":2,"verified_fuzzy":7},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 10 inbound Pith citation observations for arXiv:2506.01801."}