{"as_of":"2026-08-18T15:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28e9eb84ad00fb6deb2e64febf1a2201b56ee83de45b26490d1febd2093b5e8e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:17:38.685991Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T23:59:06.270972Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2312.14125","last_updated":"2024-06-04T17:25:20Z","snapshot_observed_at":"2026-08-14T12:12:01.418974Z","submitted_at":"2023-12-21T18:46:41Z","title":"VideoPoet: A Large Language Model for Zero-Shot Video Generation","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T17:51:05.465548Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2312.14125"},"observation_digest":"sha256:5f8e7cd7dee7d2c33f6e62e41a1d0fb56d1b28fd6c842a79e509e37b87363c70","observation_id":"f3ac6d4a-7d3f-4712-a79a-fcfab2ff46af","resolution":{"observed_at":"2026-05-15T17:51:05.696684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-13T13:43:11.024069Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2402.17177"},"observation_digest":"sha256:e22836d6300a59d88f2c1e632185520579e7b7dceb91da2384bca22bd71ab6a1","observation_id":"a30b442c-f944-48d1-ac3c-51399a50592e","resolution":{"observed_at":"2026-05-13T13:43:11.133262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-13T02:06:23.410241Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2404.02101"},"observation_digest":"sha256:6173fa446f5a54bb5661d9bd7f810f84bd3201f2754f58ef9fe849253167fa81","observation_id":"83ba4456-c92e-4173-ad7c-b949f4c528b3","resolution":{"observed_at":"2026-05-13T02:06:23.609147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-08-14T07:06:06.462400Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-16T12:04:44.162343Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2408.14837"},"observation_digest":"sha256:64c44427d2570e63bd28f07aa40a02ba186208067f24a88911c803851e32ec13","observation_id":"c9feceff-95e8-4b3e-baec-0e8f184a96fa","resolution":{"observed_at":"2026-05-16T12:04:44.253409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-17T10:09:03.767186Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:ef09bcd0331e3a342c1b801fdb07c1e5e6e7e60087a375b9b5004f9e3ec739cc","observation_id":"fcfa539f-3a60-4c06-91f7-08487f1a35db","resolution":{"observed_at":"2026-05-11T14:16:23.388206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T18:31:28.824916Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11505","last_updated":"2025-03-06T07:26:35Z","snapshot_observed_at":"2026-08-17T05:31:07.481619Z","submitted_at":"2024-11-18T12:05:27Z","title":"LaVin-DiT: Large Vision Diffusion Transformer","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:31:28.824916Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.11505"},"observation_digest":"sha256:13d3c89c991b3c017b45a070d16aab828155c225759ab7dee6b65a5aa7af315e","observation_id":"326c7df2-d902-4793-8d7f-c32d2556a744","resolution":{"observed_at":"2026-08-12T18:31:28.824916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T18:23:28.619614Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11934","last_updated":"2025-04-27T07:46:27Z","snapshot_observed_at":"2026-08-15T12:22:32.674577Z","submitted_at":"2024-11-18T15:12:59Z","title":"SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:23:28.619614Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.11934"},"observation_digest":"sha256:dcdd8c2c71c74c89946a44a9caa02ba5a84bef455ae173ba2ecce61652906e65","observation_id":"b7da27d1-0969-47ed-afbc-874079721592","resolution":{"observed_at":"2026-08-12T18:23:28.619614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T16:22:43.885081Z","title":"Photorealistic video generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13503","last_updated":"2024-11-20T17:54:41Z","snapshot_observed_at":"2026-08-12T19:44:40.357419Z","submitted_at":"2024-11-20T17:54:41Z","title":"VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T16:22:43.885081Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.13503"},"observation_digest":"sha256:d91d0beba943b43df4b0e38678813058264ace9ba890f1f4a6e6bbfdd32801ec","observation_id":"db49d1d6-96b5-4d72-afeb-27d3c7b383ed","resolution":{"observed_at":"2026-08-12T16:22:43.885081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T13:10:06.163293Z","title":"arXiv preprint arXiv:2312.06662 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16437","last_updated":"2024-11-25T14:39:18Z","snapshot_observed_at":"2026-08-16T07:36:15.917558Z","submitted_at":"2024-11-25T14:39:18Z","title":"Privacy Protection in Personalized Diffusion Models via Targeted Cross-Attention Adversarial Attack","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:10:06.163293Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.16437"},"observation_digest":"sha256:2147a96494c09955214dded25cf421fe0ad569e67d401336ab7b59a98cd124c2","observation_id":"51ab998c-1849-4323-9129-c10b6e684341","resolution":{"observed_at":"2026-08-12T13:10:06.163293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T12:36:49.227114Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17765","last_updated":"2025-07-30T10:27:47Z","snapshot_observed_at":"2026-08-17T00:14:28.635170Z","submitted_at":"2024-11-26T04:21:22Z","title":"I2VControl: Disentangled and Unified Video Motion Synthesis Control","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:36:49.227114Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.17765"},"observation_digest":"sha256:b5daf0c4e3a828aae8cd7cf0a284bb465324edbd49e4d0ec1d28a94631decc85","observation_id":"9924372b-4880-403a-9df9-878a71f22ef2","resolution":{"observed_at":"2026-08-12T12:36:49.227114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T10:09:30.560157Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19548","last_updated":"2024-11-29T08:47:46Z","snapshot_observed_at":"2026-08-15T17:12:37.171263Z","submitted_at":"2024-11-29T08:47:46Z","title":"ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:09:30.560157Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2411.19548"},"observation_digest":"sha256:6764e9a310d7687f63390f648bbbd9392671b4e3b271ac7a2e80cb938bfbb578","observation_id":"3c72ac3f-05d3-4f0f-b1a3-86efe4801777","resolution":{"observed_at":"2026-08-12T10:09:30.560157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T04:31:13.391642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01343","last_updated":"2024-12-02T10:07:59Z","snapshot_observed_at":"2026-08-17T13:09:01.658238Z","submitted_at":"2024-12-02T10:07:59Z","title":"MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:31:13.391642Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.01343"},"observation_digest":"sha256:f8378138ae671c81eef1774438f9455759aa867fb288679956b30be351a3703a","observation_id":"04fd7fa5-41df-4b4f-aaf1-7f95a8f68394","resolution":{"observed_at":"2026-08-12T04:31:13.391642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-12T00:04:08.772500Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01987","last_updated":"2025-03-24T19:50:08Z","snapshot_observed_at":"2026-08-14T02:39:08.853226Z","submitted_at":"2024-12-02T21:40:17Z","title":"ShowHowTo: Generating Scene-Conditioned Step-by-Step Visual Instructions","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:04:08.772500Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.01987"},"observation_digest":"sha256:5172d069cdb8a53e6fe029f5576b6d33015a383c178b1c82aa2318eaa341cf21","observation_id":"087efbe0-b9a4-4ab9-9432-f7c3f38a3c80","resolution":{"observed_at":"2026-08-12T00:04:08.772500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-11T22:11:52.484101Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03758","last_updated":"2025-02-26T18:16:15Z","snapshot_observed_at":"2026-08-18T05:20:03.136332Z","submitted_at":"2024-12-04T22:53:56Z","title":"ARCON: Advancing Auto-Regressive Continuation for Driving Videos","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:11:52.484101Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.03758"},"observation_digest":"sha256:bb58c378e82882b05221b0e903e9c68642f157f126938789b926dda65d339b91","observation_id":"b124ba76-0c48-474f-b54b-9c607d9288c6","resolution":{"observed_at":"2026-08-11T22:11:52.484101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-11T20:55:01.943350Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05263","last_updated":"2025-03-08T01:36:55Z","snapshot_observed_at":"2026-08-16T05:49:54.758834Z","submitted_at":"2024-12-06T18:52:20Z","title":"Mind the Time: Temporally-Controlled Multi-Event Video Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:55:01.943350Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.05263"},"observation_digest":"sha256:1b5440a1d11134f46dc02764987648acc2b9b26a75d3f9e25fd89ca0a26af679","observation_id":"3c32eeff-7f4b-40b8-a49e-6c7b23399fe4","resolution":{"observed_at":"2026-08-11T20:55:01.943350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-11T16:14:30.561174Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10255","last_updated":"2025-05-22T07:45:19Z","snapshot_observed_at":"2026-08-17T08:15:23.751188Z","submitted_at":"2024-12-13T16:24:58Z","title":"AniSora: Exploring the Frontiers of Animation Video Generation in the Sora Era","version":5},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-11T16:14:30.561174Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.10255"},"observation_digest":"sha256:2d6355be01ce1525b63728d37a19c1d65495ac6cc8a9816c7644d95d5dff5241","observation_id":"a839529d-cd95-4a27-933c-3499cfb4054e","resolution":{"observed_at":"2026-08-11T16:14:30.561174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-11T15:58:35.481731Z","title":"Photorealistic video generation with diffusion models.ArXiv preprint, abs/2312.06662, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10494","last_updated":"2025-06-09T22:48:33Z","snapshot_observed_at":"2026-08-16T09:38:59.229931Z","submitted_at":"2024-12-13T18:59:56Z","title":"SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:58:35.481731Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2412.10494"},"observation_digest":"sha256:20491b8db69e14c9de6fff98116d650d624efdd8a709b159edc99b96108a0499","observation_id":"052fda56-3df9-419b-ab7d-135594bdc82d","resolution":{"observed_at":"2026-08-11T15:58:35.481731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-10T18:53:00.040443Z","title":"Photorealistic video generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10928","last_updated":"2025-04-19T14:52:08Z","snapshot_observed_at":"2026-08-10T18:47:01.186615Z","submitted_at":"2025-01-19T03:19:47Z","title":"Generative Physical AI in Vision: A Survey","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:53:00.040443Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2501.10928"},"observation_digest":"sha256:b65f9733120ed8d317d393d0ac0de06c41264fc5a55ec2ae1f7f96c387c57f08","observation_id":"de6e8369-924f-4aa2-86ac-d29c617eb4d0","resolution":{"observed_at":"2026-08-10T18:53:00.040443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-10T17:04:25.668990Z","title":"Photorealistic video generation with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12604","last_updated":"2025-01-22T03:01:54Z","snapshot_observed_at":"2026-08-14T03:14:20.862689Z","submitted_at":"2025-01-22T03:01:54Z","title":"Image Motion Blur Removal in the Temporal Dimension with Video Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:04:25.668990Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2501.12604"},"observation_digest":"sha256:0b7aa54655435082cfca1cb8de0d88dbc8b8f7dd4bb5da895c58b0e7c909d93f","observation_id":"68405ef8-bd5e-47c7-b576-04b8bf3ba5a9","resolution":{"observed_at":"2026-08-10T17:04:25.668990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-10T12:00:07.531922Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16612","last_updated":"2025-01-28T01:14:24Z","snapshot_observed_at":"2026-08-12T21:39:57.859742Z","submitted_at":"2025-01-28T01:14:24Z","title":"CascadeV: An Implementation of Wurstchen Architecture for Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T12:00:07.531922Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2501.16612"},"observation_digest":"sha256:5240f59cc59c6fc4ef3d2cfa6e4a5fbff8848d79074b61c25ab4ac5b926cdea2","observation_id":"024ecec7-7c5b-4682-a07f-d037cc366ca0","resolution":{"observed_at":"2026-08-10T12:00:07.531922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-09T16:47:12.944417Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01061","last_updated":"2025-06-30T08:26:56Z","snapshot_observed_at":"2026-08-15T11:53:30.534687Z","submitted_at":"2025-02-03T05:17:32Z","title":"OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T16:47:12.944417Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2502.01061"},"observation_digest":"sha256:58ceda9932be6c10c30e08f9227440f811e97db9a956ce40d347becfacf3726a","observation_id":"d986b921-42e1-41b7-86bb-34b5f13f1df7","resolution":{"observed_at":"2026-08-09T16:47:12.944417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-09T10:42:54.372159Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02922","last_updated":"2025-04-30T09:04:48Z","snapshot_observed_at":"2026-08-15T09:37:47.658423Z","submitted_at":"2025-02-05T06:30:37Z","title":"Elucidating the Preconditioning in Consistency Distillation","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-09T10:42:54.372159Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2502.02922"},"observation_digest":"sha256:b804682096d0e245699121075ca34901482ac96066981b8723a511b54702ca01","observation_id":"084190aa-6b2b-4847-94df-d69ed9eff100","resolution":{"observed_at":"2026-08-09T10:42:54.372159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2504.18576","last_updated":"2026-04-24T20:54:23Z","snapshot_observed_at":"2026-08-12T12:55:11.631209Z","submitted_at":"2025-04-22T20:58:22Z","title":"DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T17:50:59.797593Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2504.18576"},"observation_digest":"sha256:7741387ad75220ac18635ce0a7017c4956e1bcff79f057eb0490c73ded124e58","observation_id":"6f4eda9c-22d6-40d1-9867-623cc893613e","resolution":{"observed_at":"2026-05-22T17:51:54.847724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-15T22:17:38.685991Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07652","last_updated":"2025-05-12T15:22:28Z","snapshot_observed_at":"2026-08-16T06:19:14.531247Z","submitted_at":"2025-05-12T15:22:28Z","title":"ShotAdapter: Text-to-Multi-Shot Video Generation with Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.685991Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.07652"},"observation_digest":"sha256:7d09d5b92f014be7d7f04e8b830033558dc57be719783d502bfcfb3a528c1f09","observation_id":"5f047eb8-026d-4dd3-b7d0-09eb4260100f","resolution":{"observed_at":"2026-08-15T22:17:38.685991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-15T21:45:39.014788Z","title":"Photorealistic Video Generation with Diffusion Models, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09089","last_updated":"2025-05-15T00:55:20Z","snapshot_observed_at":"2026-08-16T20:12:17.013341Z","submitted_at":"2025-05-14T02:51:10Z","title":"Generating time-consistent dynamics with discriminator-guided image diffusion models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:45:39.014788Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.09089"},"observation_digest":"sha256:8f061850bf6ead65bfef407ab348d968ddf87a5875ec916eca69f7ac46aa0c17","observation_id":"c99fa51a-c5a3-4a82-9e15-f7aa895e90d3","resolution":{"observed_at":"2026-08-15T21:45:39.014788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T15:31:08.409975Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15020","last_updated":"2025-05-21T01:57:22Z","snapshot_observed_at":"2026-08-17T18:56:24.692755Z","submitted_at":"2025-05-21T01:57:22Z","title":"COSMIC: Enabling Full-Stack Co-Design and Optimization of Distributed Machine Learning Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:31:08.409975Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.15020"},"observation_digest":"sha256:7a02b925ed3ff952d14e5027fb8ec0553d5c371224f453085d0a05b86e200e04","observation_id":"e18d67e2-6821-4e60-8bc7-f1f4ce907d13","resolution":{"observed_at":"2026-08-07T15:31:08.409975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T15:14:20.876919Z","title":"arXiv preprint arXiv:2312.06662 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15800","last_updated":"2025-05-25T17:44:44Z","snapshot_observed_at":"2026-08-12T22:52:59.675375Z","submitted_at":"2025-05-21T17:53:47Z","title":"Interspatial Attention for Efficient 4D Human Video Generation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:14:20.876919Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.15800"},"observation_digest":"sha256:9d4c37e95de99668baf68d38743ae85a061c7f643348e950bc9ae9b1417fac22","observation_id":"61bf796b-3e09-4c2e-87b7-cc8273bb1b61","resolution":{"observed_at":"2026-08-07T15:14:20.876919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T14:02:27.393281Z","title":"Gupta, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-07T13:55:40.621856Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:27.393281Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.20156"},"observation_digest":"sha256:95a399199c45c73f71fca514a105d6e62e2720aa463defc4652e05b82660a109","observation_id":"b77c0f73-d6df-4241-b1fe-047f7242ff90","resolution":{"observed_at":"2026-08-07T14:02:27.393281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T14:01:04.203514Z","title":"Photorealistic Video Generation with Diffusion Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20287","last_updated":"2025-05-26T17:59:03Z","snapshot_observed_at":"2026-08-14T09:09:21.683230Z","submitted_at":"2025-05-26T17:59:03Z","title":"MotionPro: A Precise Motion Controller for Image-to-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:04.203514Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2505.20287"},"observation_digest":"sha256:30eac7b384a2969fcbab91ef3b6cb28d968f822ac268c2d634dbf3ec0333c904","observation_id":"06ee8144-68cc-4d5f-a7fb-b04e5c81214d","resolution":{"observed_at":"2026-08-07T14:01:04.203514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T11:39:47.248333Z","title":"Gupta, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01801","last_updated":"2025-06-02T15:42:06Z","snapshot_observed_at":"2026-08-17T06:53:13.203522Z","submitted_at":"2025-06-02T15:42:06Z","title":"OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:47.248333Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.01801"},"observation_digest":"sha256:946e0dc8014d496e330647af06390b6b8506aa98e722be67186867f2d5f8c7b3","observation_id":"de3c8e32-8ac4-447b-9930-3376b4452548","resolution":{"observed_at":"2026-08-07T11:39:47.248333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T10:28:59.043553Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05340","last_updated":"2025-06-06T17:59:47Z","snapshot_observed_at":"2026-08-15T00:26:53.589016Z","submitted_at":"2025-06-05T17:59:40Z","title":"Exploring Diffusion Transformer Designs via Grafting","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:59.043553Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.05340"},"observation_digest":"sha256:42142a338c30e6e59f23f326f94bab2da407b4614538803505c467627654ecdb","observation_id":"6f3eef75-6580-4523-89c6-db09473afdc4","resolution":{"observed_at":"2026-08-07T10:28:59.043553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-07T10:28:30.991346Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05343","last_updated":"2025-06-11T15:48:38Z","snapshot_observed_at":"2026-08-09T14:23:10.699088Z","submitted_at":"2025-06-05T17:59:54Z","title":"ContentV: Efficient Training of Video Generation Models with Limited Compute","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:30.991346Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.05343"},"observation_digest":"sha256:6b034dc5eac800d81698c0a0b9eb32d79864595324683c9fa091ee1086190bdc","observation_id":"9aa97890-913d-46a5-b73b-1e8b60084817","resolution":{"observed_at":"2026-08-07T10:28:30.991346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-15T18:31:43.570995Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19713","last_updated":"2025-06-24T15:19:42Z","snapshot_observed_at":"2026-08-18T08:45:52.066303Z","submitted_at":"2025-06-24T15:19:42Z","title":"Guidance in the Frequency Domain Enables High-Fidelity Sampling at Low CFG Scales","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:43.570995Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.19713"},"observation_digest":"sha256:b62ae6562abff2c4d7c6e04a292aa56d38f80f1256609d2d50285b73b0edf215","observation_id":"164efe7c-5622-4255-b10c-c1789a45d6c6","resolution":{"observed_at":"2026-08-15T18:31:43.570995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-06T22:54:20.474769Z","title":"In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20452","last_updated":"2025-06-25T13:58:37Z","snapshot_observed_at":"2026-08-13T18:45:36.528193Z","submitted_at":"2025-06-25T13:58:37Z","title":"HiWave: Training-Free High-Resolution Image Generation via Wavelet-Based Diffusion Sampling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:54:20.474769Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2506.20452"},"observation_digest":"sha256:3f4ea678c889daec6dd8b1cfd4c8de82102d0777db137a3afeb2ac89a50a1e3c","observation_id":"5296e79a-5b8e-4535-bcda-9fd25decd065","resolution":{"observed_at":"2026-08-06T22:54:20.474769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-06T21:23:12.701371Z","title":"Photorealistic video generation with diffusion models, 2023.https://arxiv.org/abs/2312.06662","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00334","last_updated":"2025-07-01T00:21:24Z","snapshot_observed_at":"2026-08-14T23:20:29.901643Z","submitted_at":"2025-07-01T00:21:24Z","title":"Populate-A-Scene: Affordance-Aware Human Video Generation","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-06T21:23:12.701371Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2507.00334"},"observation_digest":"sha256:a2c9f11d74e59c6dfd1356f41029fdc190d8e65d047821bc87d4516419327cec","observation_id":"1909a206-97fe-472a-ac8f-167bc2ca06ff","resolution":{"observed_at":"2026-08-06T21:23:12.701371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-06T19:52:28.048781Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04559","last_updated":"2025-07-06T22:23:27Z","snapshot_observed_at":"2026-08-15T23:06:39.778260Z","submitted_at":"2025-07-06T22:23:27Z","title":"MambaVideo for Discrete Video Tokenization with Channel-Split Quantization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:52:28.048781Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2507.04559"},"observation_digest":"sha256:5ecaf16add52e2561d0529e6d4afb4f1d72d75e05a171aeda1c6babc1ec5cdea","observation_id":"df264099-6cb3-4fa3-84af-63348cd90316","resolution":{"observed_at":"2026-08-06T19:52:28.048781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-06T16:31:51.608613Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13224","last_updated":"2025-07-17T15:36:39Z","snapshot_observed_at":"2026-08-08T15:16:16.905667Z","submitted_at":"2025-07-17T15:36:39Z","title":"Leveraging Pre-Trained Visual Models for AI-Generated Video Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:31:51.608613Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2507.13224"},"observation_digest":"sha256:4ccc9b2ffd6627ecb5af11ffc37c67874ee968007a2024446f6cfb6b373f29e5","observation_id":"cfb24bf3-a349-4e53-8ef7-8937b27eefbc","resolution":{"observed_at":"2026-08-06T16:31:51.608613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-03T13:00:53.564961Z","title":"Photorealistic video generation with diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.01075","last_updated":"2026-05-28T18:42:26Z","snapshot_observed_at":"2026-08-16T17:25:53.373225Z","submitted_at":"2026-01-03T05:22:27Z","title":"Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T13:00:53.564961Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2601.01075"},"observation_digest":"sha256:3a1b452f3e6aa8952c2d0e3404dfab89f74180cabdd18fc437092283beaea982","observation_id":"e494224f-783c-44d9-a4e8-553a716c5c68","resolution":{"observed_at":"2026-08-03T13:00:53.564961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-13T23:54:26.281624Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.16271","last_updated":"2026-06-30T03:31:28Z","snapshot_observed_at":"2026-08-18T09:16:17.087696Z","submitted_at":"2026-03-17T09:04:10Z","title":"VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T23:54:26.281624Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2603.16271"},"observation_digest":"sha256:fcaaebbc8c9486c31da8ef3765d6a09f78ede4c14dc1461cceee81fc86cd3d79","observation_id":"9aacd0c8-bc0e-49ab-8c5f-6d1807527a11","resolution":{"observed_at":"2026-07-13T23:54:26.281624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-03T00:56:26.681009Z","title":"arXiv preprint arXiv:2312.06662 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.02330","last_updated":"2026-07-30T19:00:35Z","snapshot_observed_at":"2026-08-15T19:28:20.410138Z","submitted_at":"2026-04-02T17:59:58Z","title":"ActionParty: Multi-Subject Action Binding in Generative Video Games","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T00:56:26.681009Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2604.02330"},"observation_digest":"sha256:a7b588007023cf9021b03d1b8fe7f19e5a11bfd83a9211bd665738bface39f13","observation_id":"3e850b7c-8641-40ec-8a7b-5fbd5956c6e7","resolution":{"observed_at":"2026-08-03T00:56:26.681009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2605.12011","last_updated":"2026-05-12T12:00:48Z","snapshot_observed_at":"2026-08-15T14:50:42.092477Z","submitted_at":"2026-05-12T12:00:48Z","title":"CaloArt: Large-Patch x-Prediction Diffusion Transformers for High-Granularity Calorimeter Shower Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-13T04:40:25.725622Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2605.12011"},"observation_digest":"sha256:530a478804b6caf423ac0e6058288b85e21084266fcbed1b9c1a57279cafea79","observation_id":"46724067-61c0-43c5-8aa0-489cb5a9c90a","resolution":{"observed_at":"2026-05-13T04:42:15.910426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2605.20780","last_updated":"2026-05-20T06:22:44Z","snapshot_observed_at":"2026-08-17T16:45:41.487267Z","submitted_at":"2026-05-20T06:22:44Z","title":"Learning to Think in Physics: Breaking Shortcut Learning in Scientific Diffusion via Representation Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T06:24:04.891249Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2605.20780"},"observation_digest":"sha256:6e73a8de372af65e54829ba36dde4d06c30532c3ef011a9dd4d1e1678c3999ad","observation_id":"fea15afe-2dd3-40df-a52e-8c915ee709b1","resolution":{"observed_at":"2026-05-21T06:24:41.374599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-08-14T06:21:26.274352Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T05:35:01.339479Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:4ab55a57eecb2c74976b4d28e652bff13b2133e007811714721ab0cc334b3028","observation_id":"c478c0f3-14a3-4589-b0f0-73b3a17e2a9f","resolution":{"observed_at":"2026-07-03T16:28:39.252659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2312.06662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-07-03T23:59:06.270972Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"ddd00738-0fa8-47a1-95b7-711cfe1ca04d","year":2023},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-08-14T06:21:26.274352Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T23:50:39.241880Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:e2ddbbee50939f399b284a238f70887182204678061994e59b61185c56451439","observation_id":"0223f2b8-b3e5-4bca-b223-61ee4a7cb261","resolution":{"observed_at":"2026-07-03T23:59:06.273126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06662","snapshot_observed_at":"2026-08-03T00:34:35.423426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28760","last_updated":"2026-07-30T18:26:19Z","snapshot_observed_at":"2026-08-15T00:39:32.976416Z","submitted_at":"2026-07-30T18:26:19Z","title":"WaiT for the Signal: Simple Frequency-Aware Flow-Matching","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T00:34:35.423426Z"},"links":{"cited_paper":"/paper/2312.06662","citing_paper":"/paper/2607.28760"},"observation_digest":"sha256:864994cdf841fb2ea3ff4aea975629fe62a73393a235b908e8c762e2169b7de9","observation_id":"6c3ff821-3318-4749-98d1-c52e4123b75a","resolution":{"observed_at":"2026-08-03T00:34:35.423426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.06662/citation-record","integrity":"/paper/2312.06662/integrity","json":"/paper/2312.06662/citation-record.json","paper":"/paper/2312.06662"},"outbound":[],"paper":{"arxiv_id":"2312.06662","last_updated":"2023-12-11T18:59:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T14:35:45.631393Z","submitted_at":"2023-12-11T18:59:57Z","title":"Photorealistic Video Generation with Diffusion Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2312.06662."}