{"as_of":"2026-08-10T05:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:205889bab5e315b9f572715a8a9c9ea1f07de41d3d91e0e1d024f18d4bba045d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:26:46.659549Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:19:51.141627Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-08T14:26:46.659549Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06782","last_updated":"2025-02-12T10:07:07Z","snapshot_observed_at":"2026-08-08T14:18:27.556352Z","submitted_at":"2025-02-10T18:58:11Z","title":"Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T14:26:46.659549Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2502.06782"},"observation_digest":"sha256:4fc3651fbb852c0d9670cf6506237942c0c852999f0babadbbba6ee4c2bed644","observation_id":"d1dcf5ab-059c-4a3a-ad8c-52817e93af40","resolution":{"observed_at":"2026-08-08T14:26:46.659549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-07T19:40:21.185472Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-08T15:17:56.424720Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T19:40:21.185472Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2502.10059"},"observation_digest":"sha256:207278524bdbc3073b184ada7b268b1c3b25d8e816cbc13a22224c017b3e0ca1","observation_id":"728d888d-49af-4855-a942-ed157d68db7c","resolution":{"observed_at":"2026-08-07T19:40:21.185472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2503.21755","last_updated":"2025-08-20T15:49:30Z","snapshot_observed_at":"2026-08-10T02:47:20.223653Z","submitted_at":"2025-03-27T17:57:01Z","title":"VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-14T18:42:02.940250Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2503.21755"},"observation_digest":"sha256:e93ef3b9d0ca7bba2c67ef89b02eb295ab9dc226d43eb01321f25dfd5aa56e4f","observation_id":"bc835403-83a4-48e5-873d-630c80b32ee4","resolution":{"observed_at":"2026-05-14T18:42:03.081613Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-07T13:59:29.452382Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20292","last_updated":"2025-06-03T10:11:00Z","snapshot_observed_at":"2026-08-07T13:53:16.552171Z","submitted_at":"2025-05-26T17:59:46Z","title":"OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:29.452382Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2505.20292"},"observation_digest":"sha256:4543646199606f7393e66928c97cc964dc123946aebcee2ba50f1363735e6253","observation_id":"78244fcb-96a4-4777-9e21-b732843a7d56","resolution":{"observed_at":"2026-08-07T13:59:29.452382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-07T04:21:18.946935Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10915","last_updated":"2026-07-10T04:56:00Z","snapshot_observed_at":"2026-08-09T05:08:57.326158Z","submitted_at":"2025-06-12T17:29:40Z","title":"M4V: Multimodal Mamba for Efficient Text-to-Video Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:21:18.946935Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2506.10915"},"observation_digest":"sha256:13e47cf778787ce6549ad3c6fe77769f2108f8dd5a0dc2d4fbe1b7393ef7a18d","observation_id":"52f37071-c193-4085-8050-6f41ff3fbf83","resolution":{"observed_at":"2026-08-07T04:21:18.946935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-06T19:25:08.507165Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05675","last_updated":"2025-07-08T04:58:36Z","snapshot_observed_at":"2026-08-07T08:27:48.763738Z","submitted_at":"2025-07-08T04:58:36Z","title":"MedGen: Unlocking Medical Video Generation by Scaling Granularly-annotated Medical Videos","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:25:08.507165Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2507.05675"},"observation_digest":"sha256:d114e2753933ca382febe9847b1edfaf5add6db0c94dcdc974b30dfb660cafed","observation_id":"dc56006d-c6c1-4274-ab4e-0f9c6c3b542f","resolution":{"observed_at":"2026-08-06T19:25:08.507165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-06T16:24:04.099250Z","title":"Vchitect-2.0: Parallel trans- former for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13753","last_updated":"2025-07-18T08:59:02Z","snapshot_observed_at":"2026-08-09T23:30:14.905124Z","submitted_at":"2025-07-18T08:59:02Z","title":"Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:24:04.099250Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2507.13753"},"observation_digest":"sha256:133330233c5f9e6dcf80b51a71bea8e5478dd271f3bd1a54414aa61a8ca184f0","observation_id":"5741b480-aabe-4f75-800f-eb9fc30f5b5d","resolution":{"observed_at":"2026-08-06T16:24:04.099250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-05T17:46:33.545910Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15774","last_updated":"2025-08-21T17:59:57Z","snapshot_observed_at":"2026-08-07T08:39:29.557570Z","submitted_at":"2025-08-21T17:59:57Z","title":"CineScale: Free Lunch in High-Resolution Cinematic Visual Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T17:46:33.545910Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2508.15774"},"observation_digest":"sha256:6035f753d0ee3b6c9bd91fe7df4e7a027baa7074e968b1e218a8be3749bd6d78","observation_id":"5c9d2526-c3c7-48bc-a539-8bfdd7b56b8a","resolution":{"observed_at":"2026-08-05T17:46:33.545910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2509.24702","last_updated":"2026-04-06T10:12:03Z","snapshot_observed_at":"2026-08-02T11:34:44.120596Z","submitted_at":"2025-09-29T12:32:54Z","title":"Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T12:55:42.679016Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2509.24702"},"observation_digest":"sha256:dbf1491a67ed0d0bf5afce68c09fa1649f2ca42ba53e37de38b75a2de818c18a","observation_id":"d45b417b-8b27-49c3-b08e-f02ff5eed539","resolution":{"observed_at":"2026-05-18T12:56:24.338083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-03T17:02:33.359198Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10958","last_updated":"2026-06-01T17:54:44Z","snapshot_observed_at":"2026-08-03T18:19:00.778254Z","submitted_at":"2025-12-11T18:59:58Z","title":"WorldLens: Full-Spectrum Evaluations of Driving World Models in Real World","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T17:02:33.359198Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2512.10958"},"observation_digest":"sha256:b19ef22189125a4fd20aac919b04808e39e7e329c51db16ba9e8742cb1215ba4","observation_id":"00abd484-ba78-44e3-a6ec-bf4a1dc54be8","resolution":{"observed_at":"2026-08-03T17:02:33.359198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-03T13:24:44.479053Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.24551","last_updated":"2026-06-18T22:13:10Z","snapshot_observed_at":"2026-08-07T22:25:01.573943Z","submitted_at":"2025-12-31T01:19:14Z","title":"PhyGDPO: Physics-Aware Groupwise Direct Preference Optimization for Physically Consistent Text-to-Video Generation","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T13:24:44.479053Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2512.24551"},"observation_digest":"sha256:62d764f1a6db455cb4ab70ef02c11fae753f2eb37eddb5260daa8799bc20c1f6","observation_id":"3abc536f-de88-4818-9cb7-a999c0c5bcce","resolution":{"observed_at":"2026-08-03T13:24:44.479053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-13T23:27:11.006580Z","title":"arXiv preprint arXiv:2501.08453 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16870","last_updated":"2026-07-31T08:55:01Z","snapshot_observed_at":"2026-08-05T23:10:24.488750Z","submitted_at":"2026-03-17T17:59:55Z","title":"Demystifying Video Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T23:27:11.006580Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2603.16870"},"observation_digest":"sha256:392784e6447735e50e6d15047fadcf60ddde823cd840151fc51194f2c1ce7025","observation_id":"1d7c3677-d75b-428b-9d90-c736dbf65566","resolution":{"observed_at":"2026-07-13T23:27:11.006580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-03T02:33:53.809611Z","title":"arXiv preprint arXiv:2501.08453 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16870","last_updated":"2026-07-31T08:55:01Z","snapshot_observed_at":"2026-08-05T23:10:24.488750Z","submitted_at":"2026-03-17T17:59:55Z","title":"Demystifying Video Reasoning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:33:53.809611Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2603.16870"},"observation_digest":"sha256:709622998ae50c3ff5ed7cea934f44d1f067c209f649f46828ad3f64d7932ee0","observation_id":"11b88191-a3d4-4dfa-985f-636b32b79294","resolution":{"observed_at":"2026-08-03T02:33:53.809611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2604.19473","last_updated":"2026-04-21T13:56:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-21T13:56:36Z","title":"TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T02:45:10.577070Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2604.19473"},"observation_digest":"sha256:33a92eec03e196874e7a152e5b207cbed6b9ab6ba273caa8f05927fd23d29129","observation_id":"1f880598-6788-4466-8203-a223b55a83ae","resolution":{"observed_at":"2026-05-10T02:53:29.919945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2605.18736","last_updated":"2026-05-20T05:57:50Z","snapshot_observed_at":"2026-08-02T16:03:58.274209Z","submitted_at":"2026-05-18T17:55:39Z","title":"Spectral Progressive Diffusion for Efficient Image and Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T11:07:47.135336Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2605.18736"},"observation_digest":"sha256:7c7f33996eb0ed4463699202cf1fc70379b689deda962c806e8e23f3f47dc7bb","observation_id":"f59cc563-36ee-4d44-94d6-3ba79d4bfe22","resolution":{"observed_at":"2026-05-20T11:08:13.392425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2605.18736","last_updated":"2026-05-20T05:57:50Z","snapshot_observed_at":"2026-08-02T16:03:58.274209Z","submitted_at":"2026-05-18T17:55:39Z","title":"Spectral Progressive Diffusion for Efficient Image and Video Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T07:52:07.409740Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2605.18736"},"observation_digest":"sha256:8c5f489541c3c183a06dc93c74b2b32e3efaa4232ff891e15ffd3775e89de48d","observation_id":"5f7ce34f-94eb-4a56-a377-d24680c88e7b","resolution":{"observed_at":"2026-05-21T07:54:02.744052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2605.25801","last_updated":"2026-05-25T12:50:49Z","snapshot_observed_at":"2026-08-07T03:58:25.579837Z","submitted_at":"2026-05-25T12:50:49Z","title":"PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-29T22:24:50.679950Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2605.25801"},"observation_digest":"sha256:b10f69eb618f45fb4514adeba029baad32894bf986bb4ea2d4bbdcac0e5deb56","observation_id":"7aef4403-ab8c-4ddd-9888-2ae24b566308","resolution":{"observed_at":"2026-06-29T22:34:02.355127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2606.09828","last_updated":"2026-06-08T17:59:54Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-08T17:59:54Z","title":"Latent Spatial Memory for Video World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:42.761342Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2606.09828"},"observation_digest":"sha256:ee9c1734dd332faba4f08a3b40483464daed186241ee114f29db620211163012","observation_id":"39441c36-f316-4f64-a979-41fe82e66c8a","resolution":{"observed_at":"2026-07-03T01:07:30.541086Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2606.26916","last_updated":"2026-06-25T11:53:27Z","snapshot_observed_at":"2026-07-07T00:01:10.711037Z","submitted_at":"2026-06-25T11:53:27Z","title":"PhysRAG: Enhancing Physics-Awareness in Video Generation via Retrieval-Augmented Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T05:16:53.011837Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2606.26916"},"observation_digest":"sha256:379de9539c415e9682c2cc19da21af7c70ae1c95b0f1619db8c7d72f89caac0a","observation_id":"f970471a-9016-4fdf-8dcd-fb947d785f9c","resolution":{"observed_at":"2026-07-04T13:19:51.143006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":"2501.08453","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-04T13:19:51.141627Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models.arXiv preprint arXiv:2501.08453","venue":null,"work_id":"4bed9bae-f24a-4316-9d52-06cda3f3fcd7","year":2025},"citing_paper":{"arxiv_id":"2607.01701","last_updated":"2026-07-02T04:50:33Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T04:50:33Z","title":"Arachne: Orchestrating Cascades for Efficient Text-to-Video Model Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T06:27:48.935774Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2607.01701"},"observation_digest":"sha256:77f319c25aa650456cb9ede83828a2edaacdfac7a27a89c12315f85a39e9ba3e","observation_id":"f308f43f-bb79-4e98-b540-aebe65808fea","resolution":{"observed_at":"2026-07-03T06:37:42.231981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2501.08453 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-08-02T18:20:32.168835Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:a0b335699546184754def5e3b18ca136b7729efd0ed9268029ef8dc3a490a901","observation_id":"14051d7e-fbf4-4505-b30e-bc178db40a6a","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-02T00:49:33.849062Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14908","last_updated":"2026-07-16T12:28:01Z","snapshot_observed_at":"2026-08-08T23:56:38.953192Z","submitted_at":"2026-07-16T12:28:01Z","title":"CODA: Algorithm-Hardware Co-design for Edge Video Diffusion via NMP-Enabled Compute-Cache Operator Disaggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T00:49:33.849062Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2607.14908"},"observation_digest":"sha256:8d8e8f62d9f55e3ebdb7eaad801b89961d69202183ebb7cb42ec0d4e16b62c02","observation_id":"d3ab19fa-6d9f-44e2-b9bf-02e0a33439d9","resolution":{"observed_at":"2026-08-02T00:49:33.849062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-01T08:28:07.621970Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27380","last_updated":"2026-07-29T18:38:23Z","snapshot_observed_at":"2026-08-10T04:54:52.572049Z","submitted_at":"2026-07-29T18:38:23Z","title":"VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T08:28:07.621970Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2607.27380"},"observation_digest":"sha256:7f86b3a6d227eb22b3b2f397d41d5cf4f49797dac562ccf0d97689e5fe6eedcb","observation_id":"334d4a70-d317-40c3-8ce2-d248925386f7","resolution":{"observed_at":"2026-08-01T08:28:07.621970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08453","snapshot_observed_at":"2026-08-03T04:58:52.713725Z","title":"Vchitect-2.0: Parallel transformer for scaling up video diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29545","last_updated":"2026-07-31T15:38:56Z","snapshot_observed_at":"2026-08-08T15:30:03.649905Z","submitted_at":"2026-07-31T15:38:56Z","title":"MoRoute: Dynamic Routing for In-Context Multimodal Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T04:58:52.713725Z"},"links":{"cited_paper":"/paper/2501.08453","citing_paper":"/paper/2607.29545"},"observation_digest":"sha256:726f6e807054dc5a266c4a48efc81f8d7ae0e2a78e6b406015a57bf75956b717","observation_id":"628f01bd-f16c-44d5-af5f-911c8601e6c9","resolution":{"observed_at":"2026-08-03T04:58:52.713725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08453/citation-record","integrity":"/paper/2501.08453/integrity","json":"/paper/2501.08453/citation-record.json","paper":"/paper/2501.08453"},"outbound":[],"paper":{"arxiv_id":"2501.08453","last_updated":"2025-01-14T21:53:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T21:53:11Z","title":"Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2501.08453."}