{"as_of":"2026-08-15T11:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a23722259cc5593da6b913b87b9638d07fef46412a8198e5ba57a3416d55970a","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:15:07.491502Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04929/citation-record","integrity":"/paper/2412.04929/integrity","json":"/paper/2412.04929/citation-record.json","paper":"/paper/2412.04929"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.972881Z","title":"Slamp: Stochastic latent appearance and motion prediction","venue":null,"work_id":"5888d094-1ad3-427d-b0d3-b52767a7e562","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.335846Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:f1f6a7ecf44c2577ab58825aa5c8691fe5e90b413ed0e6578e7285423997aa0c","observation_id":"cb5d69f6-47bc-48cf-bb30-95f655809b18","resolution":{"observed_at":"2026-08-11T21:15:07.975776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13195","last_updated":"2021-06-24T17:20:21Z","snapshot_observed_at":"2026-08-13T18:57:46.780914Z","submitted_at":"2021-06-24T17:20:21Z","title":"FitVid: Overfitting in Pixel-Level Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13195","snapshot_observed_at":"2026-08-11T21:15:07.339610Z","title":"Fitvid: Overfitting in pixel-level video prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.339610Z"},"links":{"cited_paper":"/paper/2106.13195","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:14bca0e58e99c9ac45f7f0821ea8e4d4295f8ca4313485c783f861f990ce64c5","observation_id":"5ec36a95-9b70-4d7c-9087-5e50c676d990","resolution":{"observed_at":"2026-08-11T21:15:07.339610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.09392","last_updated":"2022-08-19T15:18:39Z","snapshot_observed_at":"2026-08-14T11:10:22.861778Z","submitted_at":"2022-08-19T15:18:39Z","title":"Cold Diffusion: Inverting Arbitrary Image Transforms Without Noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.09392","snapshot_observed_at":"2026-08-11T21:15:07.342569Z","title":"Cold diffusion: Inverting arbitrary image transforms without noise","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.342569Z"},"links":{"cited_paper":"/paper/2208.09392","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:a7efdf6e17c4ffc53ac91357dae7707a75e8e44281eab0db8f4342bb5f3616d8","observation_id":"9ce397fd-ccfe-4bf6-820f-37dcc0e87e5b","resolution":{"observed_at":"2026-08-11T21:15:07.342569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.964143Z","title":"Disentangling multiple features in video sequences using gaussian processes in variational autoencoders, 2020","venue":null,"work_id":"b853dbcb-829a-40e4-bdc3-b089c21e5acb","year":2020},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.345532Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:26e2136f0baff5c1987ec6d7e13b9d21b1cf2a391ef7c4f795bc76bd58be316a","observation_id":"e4a6f731-612a-48a2-9c29-f96b55538384","resolution":{"observed_at":"2026-08-11T21:15:07.967774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.956218Z","title":"Hierarchical video prediction using re- lational layouts for human-object interactions","venue":null,"work_id":"e867730f-7a1e-4e0e-8f29-448c3a5683d6","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.348272Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:853e916e08a5c2fc9ee23718044955173c6aea0836e475c1239e9da3e9ce09c3","observation_id":"fc1ec92c-c5a5-46e1-974f-f588fb187e48","resolution":{"observed_at":"2026-08-11T21:15:07.959280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.948227Z","title":"Deep video generation, prediction and completion of human action sequences","venue":null,"work_id":"17432a5d-968d-48e2-b3e8-0469649f6078","year":2018},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.350890Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:e8532776b56a2097b2fd68e1f75e5814530e18cd2277b6d814daf073f09be37e","observation_id":"b3d3a189-3bc4-4933-aabe-ea195726649f","resolution":{"observed_at":"2026-08-11T21:15:07.951580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.939596Z","title":"Im- proved conditional vrnns for video prediction","venue":null,"work_id":"3a8a83f1-f46c-4630-bc2f-23823c661d73","year":2019},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.353683Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:8e349b9f7bacff633156bfde400b1aa1bdf108eb1fee3cfbddd62fe81e694793","observation_id":"98eb20be-44ba-46f6-aca6-b8f6abaeb247","resolution":{"observed_at":"2026-08-11T21:15:07.942889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12165","last_updated":"2019-04-27T15:07:12Z","snapshot_observed_at":"2026-08-14T16:40:35.174922Z","submitted_at":"2019-04-27T15:07:12Z","title":"Improved Conditional VRNNs for Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12165","snapshot_observed_at":"2026-08-11T21:15:07.356283Z","title":"Courville","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.356283Z"},"links":{"cited_paper":"/paper/1904.12165","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:482aea1c995b5aca9dcb09c5a97a79521cfd53d62707a681b65959fa9c48cbd4","observation_id":"e036d5da-f097-47ff-a441-efd27fe95249","resolution":{"observed_at":"2026-08-11T21:15:07.356283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.930888Z","title":"Latent structured models for human pose estimation","venue":null,"work_id":"fa118746-6f8f-4874-9ce3-b06d5b54e8d4","year":2011},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.359045Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:3fd88cb7130c8e25d984df845fcb5265a874ad10cdb2db8a9b16ed99a74ff8c7","observation_id":"f0310e41-4b56-4a6d-bee9-41c61576ed87","resolution":{"observed_at":"2026-08-11T21:15:07.934130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.06571","last_updated":"2019-09-25T16:37:55Z","snapshot_observed_at":"2026-08-15T04:08:33.157509Z","submitted_at":"2019-07-15T16:27:04Z","title":"Adversarial Video Generation on Complex Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.06571","snapshot_observed_at":"2026-08-11T21:15:07.362231Z","title":"Adver- sarial video generation on complex datasets","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.362231Z"},"links":{"cited_paper":"/paper/1907.06571","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:d42773ebcb8861f8572e709872e7e8833ef56203b7ecc8a47362e293c153beba","observation_id":"9980d1d9-9af9-433d-9ae5-2c72af83bc16","resolution":{"observed_at":"2026-08-11T21:15:07.362231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.01756","last_updated":"2016-12-30T09:01:02Z","snapshot_observed_at":"2026-08-14T21:26:55.248719Z","submitted_at":"2016-12-06T11:15:28Z","title":"Video Ladder Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.01756","snapshot_observed_at":"2026-08-11T21:15:07.364922Z","title":"Video ladder networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.364922Z"},"links":{"cited_paper":"/paper/1612.01756","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:a9b9ab4afd8b73f510371b52b5fe9a2bd76880a4e96293691e4b8bfbe528f7c9","observation_id":"744c3096-c4dc-4269-8e7e-1c5c58b0fd27","resolution":{"observed_at":"2026-08-11T21:15:07.364922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.922315Z","title":"Efficient video prediction via sparsely conditioned flow matching","venue":null,"work_id":"223e5b11-b9d4-4ac8-bd33-65b4a2f687f9","year":2023},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.367782Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:b1a0768d1afe5032eeecad4e01cf8dad99e3c299859ce9b475ae7e1e98bd5f36","observation_id":"7de85026-fe8c-454c-9518-855f3d76c1ee","resolution":{"observed_at":"2026-08-11T21:15:07.925588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11435","last_updated":"2024-02-02T18:52:51Z","snapshot_observed_at":"2026-08-13T12:20:25.379741Z","submitted_at":"2023-03-20T20:28:17Z","title":"Inversion by Direct Iteration: An Alternative to Denoising Diffusion for Image Restoration","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11435","snapshot_observed_at":"2026-08-11T21:15:07.370156Z","title":"Inversion by direct iteration: An alternative to denoising diffusion for image restoration","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.370156Z"},"links":{"cited_paper":"/paper/2303.11435","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:9df1052b5ec0cdcb800d2cf250b017a3cf1fb1ba33fdd74d7dfcd549f1090d20","observation_id":"eacf2c7d-86f4-496b-9eb0-60b9edd22fe7","resolution":{"observed_at":"2026-08-11T21:15:07.370156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.914293Z","title":null,"venue":null,"work_id":"8293e11b-cbc0-4060-a09c-dcdffaffce00","year":2009},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.372786Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:6adfe4b0b44c84d57828f5bd0b57b14926cc3adb46c31c2b5cd3b51e48354caa","observation_id":"0d993695-6318-449f-baaa-9a533d97a56c","resolution":{"observed_at":"2026-08-11T21:15:07.916982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.906560Z","title":"Stochastic video generation with a learned prior, 2018","venue":null,"work_id":"ed9e5ba5-ba1a-44f2-9c72-5ff0d82f8eb5","year":2018},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.375099Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:d918db85718a6ec9557821dde8ea34fe9ffffb2bfba8f1a73d3778a18365d103","observation_id":"e9b8c0ab-922b-4126-982f-b0294b8df830","resolution":{"observed_at":"2026-08-11T21:15:07.909315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.898143Z","title":"Diffusion models beat gans on image synthesis.Advances in Neural Information Processing Systems, 34, 2021","venue":null,"work_id":"7942eb2c-4e7b-431a-bd25-b0e54c823139","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.377430Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:41150892453617052bd2cd12b0a405d2f9bbebc0f830fde92afa28024b5c1607","observation_id":"e1786f09-ade7-41a8-984f-b36f44cad9f0","resolution":{"observed_at":"2026-08-11T21:15:07.901187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.889554Z","title":"Lee, and Sergey Levine","venue":null,"work_id":"bb7cd95f-08bf-4d95-8c29-3d2ae937de29","year":2017},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.379839Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:f4a6610eebce6b3a13163694d2555cd17c803e6786356fcfdd3049829c90dcad","observation_id":"aa2a9062-ef16-440e-ab38-61123b011e0d","resolution":{"observed_at":"2026-08-11T21:15:07.892423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.880545Z","title":"Elsayed, A","venue":null,"work_id":"bde7c8b3-f101-4820-a998-1ad6252a0d23","year":2019},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.382239Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:1e4f321084b4681a710c444a7f6460e64eadc900b820009d4aa0353928ceb4fb","observation_id":"b89d39de-0671-4f01-bd33-13263b8c58ee","resolution":{"observed_at":"2026-08-11T21:15:07.884251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.871058Z","title":"Geodict: an integrated gazetteer","venue":null,"work_id":"8c3d303c-cce5-446b-856d-b2e2779923f2","year":2017},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.384789Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:45084e16ee5dfa14d3286d57d0fa9b85b5139270774ef59b98503607057eb687","observation_id":"05130741-8145-418a-bf43-a73539b44a39","resolution":{"observed_at":"2026-08-11T21:15:07.873795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.862336Z","title":"Stochastic latent residual video prediction","venue":null,"work_id":"2cd78a4e-e6a9-4a9d-b659-398b70951597","year":2020},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.387114Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:3ccf7cb0399afc943941097fdaabcfd9b5055c9273e49489675370bc6bfd35d8","observation_id":"06329801-b1bf-491c-95e1-76cf5deac1af","resolution":{"observed_at":"2026-08-11T21:15:07.865586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.854658Z","title":"Accurate grid keypoint learning for efficient video prediction","venue":null,"work_id":"3f240b74-a620-42c7-a21f-bf5e1dbba35b","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.389408Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:5c12b630a0a67e91c44c8a41a1871c967c4417deb3ef11e1de050e64ee6b985b","observation_id":"b5d3871c-9948-435c-9704-e6374020e9a3","resolution":{"observed_at":"2026-08-11T21:15:07.857370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.392179Z","title":"Goodfellow, Jean Pouget-Abadie, Mehdi Mirza, Bing Xu, David Warde-Farley, Sherjil Ozair, Aaron Courville, and Yoshua Bengio","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.392179Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:ed9653cdcd78c28aa2e0f7ddd449bea1f038d970069dc13cb5a7327255ffb7e8","observation_id":"dcd16e3e-a604-4b4c-afa8-6aaa2827095e","resolution":{"observed_at":"2026-08-11T21:15:07.392179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.842134Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"cfa6d160-5c46-4f12-b986-4890a6343462","year":2020},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.395017Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:fc6ef8ed644625e75d6aec37fe3deb4650b52ada9a16d29aff8db363e34aa05e","observation_id":"c3cd270c-6eee-4fcd-951a-d5e32211d4e1","resolution":{"observed_at":"2026-08-11T21:15:07.844794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.834639Z","title":null,"venue":null,"work_id":"5ab187d9-84b7-4b7b-bbeb-4de331d4b07d","year":2022},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.398696Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:def4e42cfdceb9ab5d7c1f264d2bed87a82be81b965f5a39385c9965d95bedcc","observation_id":"85dd213f-bbec-4590-94b8-9db822202601","resolution":{"observed_at":"2026-08-11T21:15:07.837556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.826204Z","title":"Diffusion models for video prediction and infilling, 2022","venue":null,"work_id":"81c1536e-fb46-4504-b732-28b19997c95e","year":2022},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.401528Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:ceb4dd5347209c446f904b010aa0581ab60344504fb0ca4ef0cc25dabdff7341","observation_id":"7242ba5a-7803-4b4d-8112-a8c8860c51be","resolution":{"observed_at":"2026-08-11T21:15:07.829478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-11T21:15:07.404247Z","title":"Kingma and Max Welling","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.404247Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:9b5f0b33aa9ebee37ccf2f516f1788291eaea852cbc17e2e25fd44cbfe4032fb","observation_id":"2dc41e13-9b65-4cc0-b0cd-6b73ce99d969","resolution":{"observed_at":"2026-08-11T21:15:07.404247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.816842Z","title":"Ccvs: context-aware controllable video synthesis","venue":null,"work_id":"97ad2065-e2cf-400c-93d3-1800271e9ac3","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.407652Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:e68767b4a9cd5daa070a4df8dc311a2fecc8079362b4972e082edd20ccd53b3a","observation_id":"9e7a41c4-1be4-4f8f-a96f-c20f4a1d0ebf","resolution":{"observed_at":"2026-08-11T21:15:07.820553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.01523","last_updated":"2018-04-04T17:55:40Z","snapshot_observed_at":"2026-08-14T19:29:16.513857Z","submitted_at":"2018-04-04T17:55:40Z","title":"Stochastic Adversarial Video Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.01523","snapshot_observed_at":"2026-08-11T21:15:07.410475Z","title":"Lee, Richard Zhang, Frederik Ebert, Pieter Abbeel, Chelsea Finn, and Sergey Levine","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.410475Z"},"links":{"cited_paper":"/paper/1804.01523","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:f9b1ebd3bfaa38e13430e1dc5cb3e4cf73fb6912f8a5ba94b5e18432e65b6eaa","observation_id":"449a12fb-9582-4f23-aa10-f73a4ed6ba01","resolution":{"observed_at":"2026-08-11T21:15:07.410475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.807617Z","title":"Nuwa-infinity: Autoregressive over autoregressive generation for infinite visual synthesis","venue":null,"work_id":"ef0c73ce-ae94-451b-8814-82696b1587bf","year":2022},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.413582Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:47ea1abf420e5d43fba35bb564efeaee0abb1c37fc51e2977dab9ed2ea114241","observation_id":"de571770-52f4-4d14-afa4-b1dd369f4288","resolution":{"observed_at":"2026-08-11T21:15:07.811234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04035","last_updated":"2021-11-17T17:56:08Z","snapshot_observed_at":"2026-08-12T04:55:13.588069Z","submitted_at":"2020-03-09T10:52:25Z","title":"Transformation-based Adversarial Video Prediction on Large-Scale Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04035","snapshot_observed_at":"2026-08-11T21:15:07.416678Z","title":"Transformation-based adversarial video prediction on large- scale data","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.416678Z"},"links":{"cited_paper":"/paper/2003.04035","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:f8f323962e7aca373382875e14269c3ec312defbf633c3d933f4144c44b1e650","observation_id":"a375396b-45a0-4efd-8a97-8820667b8c82","resolution":{"observed_at":"2026-08-11T21:15:07.416678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.799438Z","title":"Unsupervised learning of object structure and dynamics from videos","venue":null,"work_id":"25cee5be-cf5e-4eab-8f24-0befc6d1f71d","year":2019},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.420207Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:9dbf49f160ecc3e66f795e0c92a1147e1cfa6b06dd43804469cb4ab1bbbb0f55","observation_id":"30db7bec-20c5-4550-8f8d-35b32a8ebac8","resolution":{"observed_at":"2026-08-11T21:15:07.802051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00311","last_updated":"2018-03-16T15:15:24Z","snapshot_observed_at":"2026-08-14T20:07:56.564072Z","submitted_at":"2017-12-01T13:31:56Z","title":"Folded Recurrent Neural Networks for Future Video Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00311","snapshot_observed_at":"2026-08-11T21:15:07.422737Z","title":"Folded re- current neural networks for future video prediction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.422737Z"},"links":{"cited_paper":"/paper/1712.00311","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:cbba1125b49f8b074b1661f94087effdd8e8e7b8b81beda098b92cde0b5e1bbf","observation_id":"3fbe6b6c-2c31-4e49-977f-f7eda18efdc1","resolution":{"observed_at":"2026-08-11T21:15:07.422737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10704","last_updated":"2020-06-18T17:38:38Z","snapshot_observed_at":"2026-07-06T09:30:29.131472Z","submitted_at":"2020-06-18T17:38:38Z","title":"Latent Video Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10704","snapshot_observed_at":"2026-08-11T21:15:07.425376Z","title":"Latent video transformer","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.425376Z"},"links":{"cited_paper":"/paper/2006.10704","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:360d0b4b1a66a88c29328457cdb7b0f6624d7823ba5c8de165607804317cb306","observation_id":"be83db61-6017-40da-8e01-206a01c0a131","resolution":{"observed_at":"2026-08-11T21:15:07.425376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.792093Z","title":"Valorcarn-tetis: Terms extracted with biotex","venue":null,"work_id":"bb9debc0-10a7-4f4d-964f-6ec7e2f35282","year":2017},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.428231Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:fabddd35354875411680e5b7778eb0f86fdaa50d87dd26d4630e167c501df156","observation_id":"9e8163ae-8bd5-4963-b7d0-d9762f401e5c","resolution":{"observed_at":"2026-08-11T21:15:07.794607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.784331Z","title":"Recognizing actions using object states","venue":null,"work_id":"ab83ab06-b84d-4fd4-89b3-902a6c39face","year":2022},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.430612Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:98ff6c994da649b658a5f8c93f160d303db3707cb6ab680ca0ba4d942532cfd1","observation_id":"ccd197a9-2237-4165-8c79-a53746d843c8","resolution":{"observed_at":"2026-08-11T21:15:07.786882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.777224Z","title":"Schuldt, I","venue":null,"work_id":"2dcc9eea-964b-4a1c-a325-37092dba428e","year":2004},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.433488Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:324321cb7c164ac06726afc4bee91ea5607d03ffab206e66080865fa6c9689c7","observation_id":"897538e8-b9e0-4ffb-aa85-69bc6efa2a18","resolution":{"observed_at":"2026-08-11T21:15:07.779718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.770075Z","title":"Diverse Video Generation","venue":null,"work_id":"014ff3eb-9d5d-4924-a9e8-1f13eb914f79","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.436331Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:4c53783217aea96fca9da409b2bc6aa75ee0a7a90843e0ff98d1ad8eb669c055","observation_id":"c3a3fbc0-2e01-4e31-bfe1-8b1776840c4b","resolution":{"observed_at":"2026-08-11T21:15:07.772508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.762084Z","title":"Advanced video modeling techniques for generation and enhancement tasks","venue":null,"work_id":"28f48857-0a4f-4cca-aa30-f17eecb61322","year":2024},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.439169Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:1ffb6e81d0bb84653344c7682bbe2e7e98e25187ee47463551c03fbe6051397c","observation_id":"f42dfb17-0bc0-4b94-823a-b418588bc88b","resolution":{"observed_at":"2026-08-11T21:15:07.765352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04619","last_updated":"2021-07-09T18:15:16Z","snapshot_observed_at":"2026-08-12T10:46:22.102176Z","submitted_at":"2021-07-09T18:15:16Z","title":"Diverse Video Generation using a Gaussian Process Trigger","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04619","snapshot_observed_at":"2026-08-11T21:15:07.441678Z","title":"Diverse video generation using a gaussian process trigger","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.441678Z"},"links":{"cited_paper":"/paper/2107.04619","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:523c68db61145eaa268a61a42b2309c6b441ad13b8984d19f40f3119cf0ee4f7","observation_id":"2bcea152-00e2-48c0-a5da-760b49dabea3","resolution":{"observed_at":"2026-08-11T21:15:07.441678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.754190Z","title":"Video predic- tion by modeling videos as continuous multi-dimensional processes","venue":null,"work_id":"1d05e603-b1bf-4830-b030-22ea69c2993f","year":null},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.444228Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:6d8f8511581e8a19a5dfa4d63ae9acb602d20bdd4ef4b9c566f5eac3416fab6d","observation_id":"aa13b548-dddd-4639-9031-61390339e17b","resolution":{"observed_at":"2026-08-11T21:15:07.757131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.746758Z","title":"Video dynamics prior: An internal learning approach for robust video enhancements","venue":null,"work_id":"37b0e262-73e4-4c27-a6fe-7406b752dfa3","year":2023},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.447059Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:f4e675f3b8c2afaa15ba9332c6ddd1d9c8c44eb12773b65a37acc7df0b1f8ea7","observation_id":"8f51b6e2-1893-4218-ab13-6aedf937d800","resolution":{"observed_at":"2026-08-11T21:15:07.749461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.739082Z","title":"Video decomposition prior: Editing videos layer by layer","venue":null,"work_id":"bfdf2bd4-0d8e-400d-bd56-52a707ff4a8c","year":2024},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.449565Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:a0e6f8c640d1a2834636f32ba19a7aa8c4774f711307dc1eac52bb6434c144d5","observation_id":"0528be59-a27b-4da6-808e-8d8c85ee78f6","resolution":{"observed_at":"2026-08-11T21:15:07.741916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.731183Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"62c28400-444a-4922-bae4-51b21870f5ba","year":2020},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.452308Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:9e5027c9c7bd38c9b4682a41dee2a8a8212fae94ba8cbc798ae584b02225a9b9","observation_id":"b18aa5dc-cc5b-4acd-bcb1-14bdc575648c","resolution":{"observed_at":"2026-08-11T21:15:07.734289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.722231Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":"71c095aa-b2e6-4246-9606-592b0c65d3a6","year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.454804Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:88f3726c06a6b8177d2457014a6466ff3d5140aee00b20bb370ca8b6369383ef","observation_id":"ea83335c-f85a-49b9-81c8-12df7bcf6e64","resolution":{"observed_at":"2026-08-11T21:15:07.725751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.713299Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild, 2012","venue":null,"work_id":"3770ae6f-d86d-4453-852b-492bab283f0d","year":2012},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.457337Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:c772e6951d96ced0dc7b6e0febc0022a1f75f3cf4e4445e62d1ced861a7a2e57","observation_id":"6b0f5cfe-5bee-4d1d-838b-a42043963204","resolution":{"observed_at":"2026-08-11T21:15:07.716570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.704116Z","title":"Unsupervised learning of video representations using lstms","venue":null,"work_id":"1aab95ca-8133-41f6-889e-d3ada71d9738","year":2015},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.460124Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:14ce66c2d47c73a8ff3214fde3db8be73ce724e80df49987d14e34af1a280659","observation_id":"4f2444f9-704c-4329-96c1-606a97fa461a","resolution":{"observed_at":"2026-08-11T21:15:07.707467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.696443Z","title":"To- wards accurate generative models of video: A new metric and challenges, 2018","venue":null,"work_id":"abbe2993-ae91-4c83-b1ee-56fb2cf639df","year":2018},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.462747Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:ac58e814a6c0186fe1c6e40f7b28f06582047e035babcc0ca6a8379b6155e285","observation_id":"8442c355-bcbc-4a19-8cc3-68e5177501da","resolution":{"observed_at":"2026-08-11T21:15:07.699230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08033","last_updated":"2018-01-08T01:21:32Z","snapshot_observed_at":"2026-08-14T20:51:52.386509Z","submitted_at":"2017-06-25T04:18:12Z","title":"Decomposing Motion and Content for Natural Video Sequence Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08033","snapshot_observed_at":"2026-08-11T21:15:07.465138Z","title":"Decomposing motion and content for natural video sequence prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.465138Z"},"links":{"cited_paper":"/paper/1706.08033","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:51145903289ecb07922656403fa8da6c3105165aab2a690d354312e6e3cf67c5","observation_id":"19bc4ff0-74cd-40b3-80f2-8648b452c60e","resolution":{"observed_at":"2026-08-11T21:15:07.465138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.687951Z","title":"Learning to generate long-term future via hierarchical prediction, 2017","venue":null,"work_id":"e691f996-3398-49c6-9716-15b728bafce0","year":2017},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.468504Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:7c646f26928bc86c427c679aa1714ba3874af68cba039c8c3e5ce9dfcdb03ecb","observation_id":"afb4ad6d-f2cf-4b54-9095-9f6b203432df","resolution":{"observed_at":"2026-08-11T21:15:07.691241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.679672Z","title":"Le, and Honglak Lee","venue":null,"work_id":"f94bfebe-402a-4bb3-be00-1485b1f99868","year":null},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.470789Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:612c1fc023bec5adc97e6c512b30ee1147e78ba69be9468420df5b03917884e8","observation_id":"d0855b85-232c-47b6-9d71-a265ea7e85e0","resolution":{"observed_at":"2026-08-11T21:15:07.682624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.670530Z","title":"Mcvd-masked conditional video diffusion for prediction, gen- eration, and interpolation","venue":null,"work_id":"8e805bfc-b512-4df2-8231-3579083cf8e8","year":2022},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.473417Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:28335b6e4d942daa9d25a4cda7cc58f5a155e52025ee09f2ba36af61f3b4d709","observation_id":"c67d334e-bdcd-4a51-b8ca-e9f26ca9002f","resolution":{"observed_at":"2026-08-11T21:15:07.673388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.660724Z","title":"Patch to the future: Unsupervised visual prediction","venue":null,"work_id":"ce68396d-f579-4f0b-b609-9d8dd0b6ca99","year":2014},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.476322Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:2958724e1582629b0960d08b413f780e65446c4a9822c1c8d99dd7d472c1238c","observation_id":"c6ab281f-7be5-445c-a6f4-fb5b164defea","resolution":{"observed_at":"2026-08-11T21:15:07.663519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.651649Z","title":"The pose knows: Video forecasting by generating pose futures","venue":null,"work_id":"d3b9db9b-4f3f-42c8-992b-5fb9604af443","year":null},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.479681Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:c1978053c2f7b600b52a93fae2b09c5e0f946854d32839b3c40e5d0ed30378d2","observation_id":"27af64d1-1d58-443c-9bf6-d19f3f036969","resolution":{"observed_at":"2026-08-11T21:15:07.654623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.642669Z","title":"Eidetic 3d LSTM: A model for video prediction and beyond","venue":null,"work_id":"c6db68cf-91a1-4e39-9af6-336f3e24354b","year":2019},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.482460Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:768cae164da74eeac949d9e7fc631177187849aac239c4c5582e5bee5fd55bd2","observation_id":"9234fdd1-06ba-4a3b-bf77-0e824425e5d1","resolution":{"observed_at":"2026-08-11T21:15:07.645608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.634525Z","title":"Hierarchical long-term video prediction without super- vision, 2018","venue":null,"work_id":"82717a2c-accf-41bb-ad09-f699eeb900ca","year":2018},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.485552Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:c96d99ba2bc339f3d9c80aa308265ab73dad9144a88cdf85deb0e57a11871c66","observation_id":"6e92218b-1052-458c-91c1-f24a87502f5d","resolution":{"observed_at":"2026-08-11T21:15:07.637219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-08-13T14:30:50.605700Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-11T21:15:07.488359Z","title":"Videogpt: Video generation using vq-vae and transform- ers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.488359Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:6f9dc396ca04d92e86182e1f207798bdc3b1614558d8a013a53d8e79b97d3829","observation_id":"a319676c-44ff-46dd-9ce0-f27cd60e3a03","resolution":{"observed_at":"2026-08-11T21:15:07.488359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:15:07.624160Z","title":"A data-driven approach for event prediction","venue":null,"work_id":"ad604e63-2dcb-41ac-b915-400350465c10","year":2010},"citing_paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T21:15:07.491502Z"},"links":{"citing_paper":"/paper/2412.04929"},"observation_digest":"sha256:e593bcbc30442439a2d6a77b43320fb175fcea9f9c749a45489b7c2f46e8860d","observation_id":"8bdc8d78-1edf-4432-85c2-47250b3aa204","resolution":{"observed_at":"2026-08-11T21:15:07.628798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.04929","last_updated":"2024-12-09T02:54:53Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:43:08.852753Z","submitted_at":"2024-12-06T10:34:50Z","title":"Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2412.04929."}