{"as_of":"2026-08-14T23:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb38597128c14911a408066f2297ff711eb3f4a2ce1fc3124f78fe8901dcfde7","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:14:22.689279Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:03:15.907426Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-07T14:03:15.907426Z","title":"Pre-trained video generative models as world simula- tors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20171","last_updated":"2025-05-26T16:12:41Z","snapshot_observed_at":"2026-08-12T21:18:08.938444Z","submitted_at":"2025-05-26T16:12:41Z","title":"Long-Context State-Space Video World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:03:15.907426Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2505.20171"},"observation_digest":"sha256:aa84bd4a270d9cd271d2655fdc1830cb58e330a4c702dcd7343f8d6948d0d2a0","observation_id":"8b281877-bc57-4655-8c14-5222c3132691","resolution":{"observed_at":"2026-08-07T14:03:15.907426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-07T11:15:15.192689Z","title":"Pre-trained video generative models as world simulators.arXiv preprint arXiv:2502.07825, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03065","last_updated":"2025-06-03T16:42:37Z","snapshot_observed_at":"2026-08-14T21:26:54.666946Z","submitted_at":"2025-06-03T16:42:37Z","title":"Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:15.192689Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2506.03065"},"observation_digest":"sha256:3b7c0e58f66da6381a03091a61092045bbf4391c646849671d1a603c158a702e","observation_id":"2ec664b1-d70f-464c-b996-844981a4de2a","resolution":{"observed_at":"2026-08-07T11:15:15.192689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-13T10:05:34.967093Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T22:57:07.883617Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2506.21539"},"observation_digest":"sha256:6c782799ff6274c6d1dc20208b3cf812db6ceef3e409a35b75726ea6c942f227","observation_id":"ccb6ddd4-fa94-48af-b038-c88b46a2c13b","resolution":{"observed_at":"2026-05-11T22:57:08.130802Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-06T21:56:11.850755Z","title":"Pre-trained video generative models as world simulators","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23135","last_updated":"2025-06-29T08:19:45Z","snapshot_observed_at":"2026-08-14T01:38:32.199413Z","submitted_at":"2025-06-29T08:19:45Z","title":"RoboScape: Physics-informed Embodied World Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:56:11.850755Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2506.23135"},"observation_digest":"sha256:50584aa1bfeb31c8046d706fcaab72f81062efe9ab02ada72f74239cec72139f","observation_id":"44bf1fbe-ec70-4b5e-9f81-f11d1edc7221","resolution":{"observed_at":"2026-08-06T21:56:11.850755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-06T15:27:01.234367Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15824","last_updated":"2025-07-21T17:30:46Z","snapshot_observed_at":"2026-08-07T10:31:41.147971Z","submitted_at":"2025-07-21T17:30:46Z","title":"Can Your Model Separate Yolks with a Water Bottle? Benchmarking Physical Commonsense Understanding in Video Generation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:27:01.234367Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2507.15824"},"observation_digest":"sha256:6a2e07937503f653180bc9170c69cda7df9de6f88aa913abcb4970052cf47f78","observation_id":"a72f13bd-15f5-4954-abc2-fc2f681ef209","resolution":{"observed_at":"2026-08-06T15:27:01.234367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2510.10125","last_updated":"2026-03-01T08:24:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-11T09:13:10Z","title":"Ctrl-World: A Controllable Generative World Model for Robot Manipulation","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T01:14:10.174044Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2510.10125"},"observation_digest":"sha256:dc8a6e3db3212aa6473f0a41933cf4f8169bd38452ccfb89b86d16f491860559","observation_id":"9389cae8-231a-48b5-b0be-e3f2ef303831","resolution":{"observed_at":"2026-05-16T01:14:10.406401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2510.26433","last_updated":"2026-04-06T15:21:53Z","snapshot_observed_at":"2026-08-14T22:18:10.009337Z","submitted_at":"2025-10-30T12:28:40Z","title":"Co-Evolving Latent Action World Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T02:51:21.569303Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2510.26433"},"observation_digest":"sha256:e89e47c02a96b45f89c041601eab7c35cbb2f466caf0b40a68c5e005d4c956b3","observation_id":"9ff7b020-b15b-454c-89b4-95c650b2b7f4","resolution":{"observed_at":"2026-05-18T02:52:21.672604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2512.04678","last_updated":"2025-12-28T11:15:39Z","snapshot_observed_at":"2026-08-04T14:52:25.854038Z","submitted_at":"2025-12-04T11:12:13Z","title":"Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T18:17:54.943863Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2512.04678"},"observation_digest":"sha256:d39342218eb1f8fc09f15326a9ad2013616544bef183c204cc9e873965ad5ffa","observation_id":"9931c735-97cd-4f46-81fc-c2c37a47fca0","resolution":{"observed_at":"2026-05-16T18:17:55.157621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-03T15:46:07.784278Z","title":"Pre-trained video generative models as world simulators.arXiv preprint arXiv:2502.07825, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.15702","last_updated":"2026-07-01T03:39:09Z","snapshot_observed_at":"2026-08-06T15:52:47.972204Z","submitted_at":"2025-12-17T18:53:29Z","title":"End-to-End Training for Autoregressive Video Diffusion via Self-Resampling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T15:46:07.784278Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2512.15702"},"observation_digest":"sha256:b6d6fc1608fc3d0c6a2dc9874c3b6f6a56c53d6e22bfff2781204b106253f0da","observation_id":"4fd3a81b-c6f1-4e13-9c4e-7d369e8ca2ba","resolution":{"observed_at":"2026-08-03T15:46:07.784278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-03T12:06:26.663155Z","title":"Pre-trained video generative models as world simula- tors.arXiv preprint arXiv:2502.07825, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.04453","last_updated":"2026-07-01T06:26:33Z","snapshot_observed_at":"2026-08-13T13:04:43.733874Z","submitted_at":"2026-01-07T23:49:52Z","title":"UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T12:06:26.663155Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2601.04453"},"observation_digest":"sha256:f7bb464cfcf651741c1b44ee53cc55904d2841b4276002d080c8b3dc77cc3359","observation_id":"b1bd8532-1cd8-4084-aab3-8968e0dece78","resolution":{"observed_at":"2026-08-03T12:06:26.663155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2603.04727","last_updated":"2026-05-18T17:56:22Z","snapshot_observed_at":"2026-08-14T16:46:57.618984Z","submitted_at":"2026-03-05T02:00:53Z","title":"Are Multimodal LLMs Ready for Surveillance? A Reality Check on Zero-Shot Anomaly Detection in the Wild","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T12:23:02.046757Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2603.04727"},"observation_digest":"sha256:e46092cf16ed3a33c8698ed75eed023e7b581bfbb1df19af109ebf924d6b9a45","observation_id":"6a49fd73-fa0e-47c9-a702-09754c141124","resolution":{"observed_at":"2026-05-21T12:24:10.642590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2605.06298","last_updated":"2026-05-08T08:40:29Z","snapshot_observed_at":"2026-08-11T16:06:00.559955Z","submitted_at":"2026-05-07T14:02:00Z","title":"Render, Don't Decode: Weight-Space World Models with Latent Structural Disentanglement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T13:39:05.969414Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2605.06298"},"observation_digest":"sha256:77147857fa74757b270174031845b1a4ea4c7b4968a647cca1a3810987782b83","observation_id":"451cbc93-4de4-4b54-85ed-481ef0313753","resolution":{"observed_at":"2026-05-11T18:51:07.886021Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2605.06298","last_updated":"2026-05-08T08:40:29Z","snapshot_observed_at":"2026-08-11T16:06:00.559955Z","submitted_at":"2026-05-07T14:02:00Z","title":"Render, Don't Decode: Weight-Space World Models with Latent Structural Disentanglement","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:46:31.004068Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2605.06298"},"observation_digest":"sha256:3a7cbcfe23e73579c5efb45d944e7c106ca2679b36256c72d33868d3000410a8","observation_id":"3b4dc9c1-d2da-4d6d-8d23-86abc5e4610c","resolution":{"observed_at":"2026-05-11T04:20:58.445345Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2605.15725","last_updated":"2026-05-15T08:22:37Z","snapshot_observed_at":"2026-08-06T08:15:14.018564Z","submitted_at":"2026-05-15T08:22:37Z","title":"DiLA: Disentangled Latent Action World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T19:35:37.527479Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2605.15725"},"observation_digest":"sha256:abd4431128ab363ede93308a275ecbe906e27fedcbebcceb0b54cd6c373c330a","observation_id":"18da8698-da7c-4f7c-ba0d-8923f9c8c58a","resolution":{"observed_at":"2026-05-20T19:38:56.309993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2606.04130","last_updated":"2026-06-02T18:40:24Z","snapshot_observed_at":"2026-07-06T23:44:19.059079Z","submitted_at":"2026-06-02T18:40:24Z","title":"CLAW: Learning Continuous Latent Action World Models via Adversarial Latent Regularization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T09:55:00.402411Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2606.04130"},"observation_digest":"sha256:47d0625f413fdca4be69287ded2b5685b1e4eccec510f25060ee291b33ff56e0","observation_id":"91be3498-76fc-4700-a00a-06b14cba4d1e","resolution":{"observed_at":"2026-07-02T03:36:29.596078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":"2502.07825","doi":"10.48550/arxiv.2502.07825","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pre-trained video generative models as world simulators","venue":"ArXiv.org","work_id":"713bd8a6-d96d-4e96-aa83-530d04a03c81","year":2025},"citing_paper":{"arxiv_id":"2606.12072","last_updated":"2026-06-10T13:40:19Z","snapshot_observed_at":"2026-08-02T21:32:50.432496Z","submitted_at":"2026-06-10T13:40:19Z","title":"World Model Self-Distillation: Training World Models to Solve General Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T10:16:35.511426Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2606.12072"},"observation_digest":"sha256:c53703a03c191eae645e4c02fe6848dbbf460088fe7c83c6ba9f3e59dd1c41a8","observation_id":"1b10620f-daab-4c2f-b89a-4966c21ce3e8","resolution":{"observed_at":"2026-06-27T10:20:48.824778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07825","snapshot_observed_at":"2026-08-02T14:50:11.679991Z","title":"Pre-trained video generative models as world simulators.arXiv preprint arXiv:2502.07825, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16204","last_updated":"2026-05-07T00:40:32Z","snapshot_observed_at":"2026-08-06T07:49:27.049032Z","submitted_at":"2026-05-07T00:40:32Z","title":"Masked Diffusion Language Models are Strong and Steerable Text-Based World Models for Agentic RL","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T14:50:11.679991Z"},"links":{"cited_paper":"/paper/2502.07825","citing_paper":"/paper/2607.16204"},"observation_digest":"sha256:978f5a5b74a428d2a003127e2975685f7a11893756c8d2c69fa2f383a27820d2","observation_id":"dce3e5b2-6690-4974-ba4b-59cdfde4c4c8","resolution":{"observed_at":"2026-08-02T14:50:11.679991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07825/citation-record","integrity":"/paper/2502.07825/integrity","json":"/paper/2502.07825/citation-record.json","paper":"/paper/2502.07825"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.236211Z","title":"Leveraging procedural generation to benchmark reinforcement learning","venue":null,"work_id":"017b4130-19fd-40a9-880e-c395ece2e51c","year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.314764Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:4e3f2d0b1ced18bb596020a5a37ac9586ed9794bb5dd2a11247a5cae9d901953","observation_id":"ee870583-4950-4112-96ea-2811eb2cbfba","resolution":{"observed_at":"2026-08-08T15:14:23.290690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.026192Z","title":null,"venue":null,"work_id":"e7b66e45-9dfc-4a8a-9104-d44429f77608","year":2023},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.689279Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:e4e1df48422d224e9e5be1a3629e70c076f64d83f3e709d5aa759e54fdc5c9d1","observation_id":"90e4d933-041a-468f-ba3a-8af6d39daee1","resolution":{"observed_at":"2026-08-08T15:14:23.030767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03570","last_updated":"2024-10-15T20:56:47Z","snapshot_observed_at":"2026-08-13T04:25:38.930384Z","submitted_at":"2024-02-05T22:43:57Z","title":"Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03570","snapshot_observed_at":"2026-08-08T15:14:22.320381Z","title":"Zihan Ding, Amy Zhang, Yuandong Tian, and Qinqing Zheng","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.320381Z"},"links":{"cited_paper":"/paper/2402.03570","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:8c3436d5cd70444c1a4e171cc0094289377284e058c107d156fa853ec8c78f12","observation_id":"9663e929-9b0a-4cd9-83b4-1766451ae060","resolution":{"observed_at":"2026-08-08T15:14:22.320381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11894","last_updated":"2022-08-06T10:09:47Z","snapshot_observed_at":"2026-08-13T15:17:55.025798Z","submitted_at":"2022-06-23T17:59:33Z","title":"MaskViT: Masked Visual Pre-Training for Video Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11894","snapshot_observed_at":"2026-08-08T15:14:22.326566Z","title":"Maskvit: Masked visual pre-training for video prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.326566Z"},"links":{"cited_paper":"/paper/2206.11894","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:85d273533c4c875ecbdb2a7e527b02fe3a6b77bc52bd5611b693488599a734fc","observation_id":"72503797-2ce4-4cca-ac27-8733d13e0d42","resolution":{"observed_at":"2026-08-08T15:14:22.326566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-08T15:14:22.335380Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.335380Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:207c75b25cc921b20fae1031c8470787c45364dc68ada5002e4e8b362c3ed5b9","observation_id":"8bfdd34f-6ae0-47a7-b38c-cc55a8d82e67","resolution":{"observed_at":"2026-08-08T15:14:22.335380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-08T15:14:22.338761Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.338761Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:893bd433f25d49e7ba9288dfacf055b09a771390abe7a08a6fc1fbbbbdd9b60d","observation_id":"d56149ff-b739-429b-ac47-ffd5932096d4","resolution":{"observed_at":"2026-08-08T15:14:22.338761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-08T15:14:22.341684Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.341684Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:3182d592979bc10200055da852f743275a3f64e60086787c4c7d621bf395587a","observation_id":"a6b98859-75b8-48a6-b8b8-3ac1bec75311","resolution":{"observed_at":"2026-08-08T15:14:22.341684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-08T15:14:22.344838Z","title":"Vincent Micheli, Eloi Alonso, and François Fleuret","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.344838Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:d4817472724eecb31e7fe2c953e1c2e5ab78f183de81958d4585409d4f54fbf6","observation_id":"40edee54-cc02-41f5-ba4e-fc10ed38d4b8","resolution":{"observed_at":"2026-08-08T15:14:22.344838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12822","last_updated":"2024-11-24T19:37:04Z","snapshot_observed_at":"2026-08-14T11:11:40.644762Z","submitted_at":"2024-10-01T13:48:31Z","title":"AVID: Adapting Video Diffusion Models to World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12822","snapshot_observed_at":"2026-08-08T15:14:22.384783Z","title":"Avid: Adapting video diffusion models to world models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.384783Z"},"links":{"cited_paper":"/paper/2410.12822","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:441de3f107a2e8ef5989fbdef2be65634ebe742e4ef77c43fd89cb2228fb4fb5","observation_id":"5ab366d8-1b72-45cc-9dbe-5f16d7401add","resolution":{"observed_at":"2026-08-08T15:14:22.384783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-08T15:14:22.421466Z","title":"15 John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, and Oleg Klimov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.421466Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:16b82bb3a46d1228bf00baa85ee7a561c93cba04c49c5cfa808efe74d45524fa","observation_id":"680939e0-8980-497a-ba13-e3c4320eaaee","resolution":{"observed_at":"2026-08-08T15:14:22.421466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T23:20:42.336514Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-08T15:14:22.445941Z","title":"Karen Simonyan and Andrew Zisserman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.445941Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:cd373df4af2ed2f16b838bf6fb0aca6aacbd300580c9a7a73270bb0f44ce6a8c","observation_id":"5a1808cd-0788-4f09-8c14-6d73e8bb92f1","resolution":{"observed_at":"2026-08-08T15:14:22.445941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T15:14:22.451787Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timothée Lacroix, Baptiste Rozière, Naman Goyal, Eric Hambro, Faisal Azhar, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.451787Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:4b9d515e55a96deec8dcea735e48a6b38fcae0abd27ecb3d10c33553be44e7a8","observation_id":"dd921605-37e4-42f0-89ed-946fb3b1e98c","resolution":{"observed_at":"2026-08-08T15:14:22.451787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-08T15:14:22.454216Z","title":"Towards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.454216Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:5830216a155a467eabc938c0ca88f5ab0f37b2a50e8ff5c89341a08511625f4f","observation_id":"77c9f3c2-7c61-47be-90f1-3185a557a1cd","resolution":{"observed_at":"2026-08-08T15:14:22.454216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09455","last_updated":"2024-06-12T18:55:51Z","snapshot_observed_at":"2026-08-14T17:57:40.504742Z","submitted_at":"2024-06-12T18:55:51Z","title":"Pandora: Towards General World Model with Natural Language Actions and Video States","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09455","snapshot_observed_at":"2026-08-08T15:14:22.461361Z","title":"Pandora: Towards general world model with natural language actions and video states","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.461361Z"},"links":{"cited_paper":"/paper/2406.09455","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:851812c6cd07aae2d5f0489f252df96763deb16614a71b88379dd388dd8d1777","observation_id":"fa2a7b8e-940e-45cc-baf2-8041ae8be735","resolution":{"observed_at":"2026-08-08T15:14:22.461361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-08-13T14:30:50.605700Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-08T15:14:22.464157Z","title":"Videogpt: Video generation using vq-vae and transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.464157Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:85a749e177629fb3cb5ff102df4b3f41b8419e4bb81d9c1b8fec412e706f8d25","observation_id":"332417a7-d18f-4d7d-bc51-6eea2aa96452","resolution":{"observed_at":"2026-08-08T15:14:22.464157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00887","last_updated":"2024-12-01T16:53:02Z","snapshot_observed_at":"2026-08-13T17:15:11.071381Z","submitted_at":"2024-12-01T16:53:02Z","title":"Playable Game Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00887","snapshot_observed_at":"2026-08-08T15:14:22.470515Z","title":"Playable game generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.470515Z"},"links":{"cited_paper":"/paper/2412.00887","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:7cc5fa86b38753e7a10964b1231c947b3f29997de28f4299df8695cc0b6684b2","observation_id":"baa8a1ec-19ac-41a4-b215-4e9d6c1662b8","resolution":{"observed_at":"2026-08-08T15:14:22.470515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15836","last_updated":"2025-09-02T08:16:33Z","snapshot_observed_at":"2026-08-12T23:37:00.455905Z","submitted_at":"2024-06-22T12:40:03Z","title":"Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15836","snapshot_observed_at":"2026-08-08T15:14:22.473732Z","title":"Yang Zhang, Chenjia Bai, Bin Zhao, Junchi Yan, Xiu Li, and Xuelong Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.473732Z"},"links":{"cited_paper":"/paper/2406.15836","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:9ae09f49487628452799d0c12d655e7c4f00228288ee8534058f9c9eab78d877","observation_id":"60746027-81d9-4eb2-a7d1-62ecc94c5fc5","resolution":{"observed_at":"2026-08-08T15:14:22.473732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12802","last_updated":"2024-06-18T17:13:50Z","snapshot_observed_at":"2026-08-12T23:39:52.527355Z","submitted_at":"2024-06-18T17:13:50Z","title":"Decentralized Multi-Robot Line-of-Sight Connectivity Maintenance under Uncertainty","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12802","snapshot_observed_at":"2026-08-08T15:14:22.476911Z","title":"Fangqi Zhu, Hongtao Wu, Song Guo, Yuxiao Liu, Chilam Cheang, and Tao Kong","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.476911Z"},"links":{"cited_paper":"/paper/2406.12802","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:bb95893ae21b13e8d95c16b50b62f5582259b3434e822e0c7d66fff9efcee9a4","observation_id":"aaf386df-6f94-4e3d-ad18-43773697db6c","resolution":{"observed_at":"2026-08-08T15:14:22.476911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.205964Z","title":null,"venue":null,"work_id":"ab86b142-5ea8-474e-b573-69e5190d65c5","year":2013},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.491168Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:a8b5588dcf4a3c82f72655a9eb9711f6592a1ddd44f041a6ed7da6ea4f145bcb","observation_id":"88fc553c-18e6-4734-b55f-578407f7e3af","resolution":{"observed_at":"2026-08-08T15:14:23.209385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.185854Z","title":null,"venue":null,"work_id":"a4d7d6a0-b5e6-4376-a01c-e1d134f36660","year":2023},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.581372Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:b7e31499e241e0eca4673189ccc115eda4b5627011030eb59b7661a0c8707841","observation_id":"3eee1721-3506-40a8-ab07-51f925605047","resolution":{"observed_at":"2026-08-08T15:14:23.189692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.037818Z","title":"For our implementation of DWS, we utilized Open-Sora version 1.2 as our base model","venue":null,"work_id":"1dbd3bd5-fb1e-444b-a55a-a616cd684d99","year":2023},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.640549Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:80ff996300e59269c9d7a4b7c9b6324b3346c2aaddcdeda69e4cbb8d59a4bf1c","observation_id":"f38cf5cd-2132-4fdd-a127-95682bdefd78","resolution":{"observed_at":"2026-08-08T15:14:23.094037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.196556Z","title":"In terms of the hyperparameter of DQN, we followed the default setting provided at https://github.com/ vwxyzjn/cleanrl/blob/master/cleanrl/dqn_atari.py","venue":null,"work_id":"49988146-85ba-44c6-8cd8-613ab32c5ee1","year":2022},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.532174Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:a645de29952d44ad0d0181ed45757c39665d2c30934d955ea535a7fd2a8e889b","observation_id":"fdba8374-4b4b-4d50-82b1-1538230ed792","resolution":{"observed_at":"2026-08-08T15:14:23.200014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-08T15:14:22.448687Z","title":"Yuval Tassa, Yotam Doron, Alistair Muldal, Tom Erez, Yazhe Li, Diego de Las Casas, David Budden, Abbas Abdolmaleki, Josh Merel, Andrew Lefrancq, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.448687Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:4d549557e6c2246f8d99677d8e194b7b1ac40674ca2a2bff941de300ba22daa1","observation_id":"939260c3-2479-44fa-b1c5-9df8e07854eb","resolution":{"observed_at":"2026-08-08T15:14:22.448687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T15:14:22.257646Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.257646Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:e574b253501ebc27a93283419520a79cbe770a85fb7a9d5e55c36590e69c03c6","observation_id":"c1ecb83b-8d3f-4f2e-b945-bf911d90bf4c","resolution":{"observed_at":"2026-08-08T15:14:22.257646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03568","last_updated":"2024-12-04T18:59:05Z","snapshot_observed_at":"2026-08-11T22:12:56.057667Z","submitted_at":"2024-12-04T18:59:05Z","title":"The Matrix: Infinite-Horizon World Generation with Real-Time Moving Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03568","snapshot_observed_at":"2026-08-08T15:14:22.323651Z","title":"The matrix: Infinite-horizon world generation with real-time moving control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.323651Z"},"links":{"cited_paper":"/paper/2412.03568","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:abb622680001d70872ab11a4c9ef70b90a0c7d6e08e9d7668f0e919bc9f3f7a6","observation_id":"6d765c23-c578-4461-8bd4-e6a6e6b9c902","resolution":{"observed_at":"2026-08-08T15:14:22.323651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-08-14T07:06:06.462400Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14837","snapshot_observed_at":"2026-08-08T15:14:22.457055Z","title":"Diffusion models are real-time game engines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.457055Z"},"links":{"cited_paper":"/paper/2408.14837","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:2635962f03eee2d7bcfb3ba8582259ed3ce225deb1f872f458f60121ab1b4986","observation_id":"c5bae560-1813-43c0-b9a8-a13fbb97552c","resolution":{"observed_at":"2026-08-08T15:14:22.457055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-08T15:14:22.329614Z","title":"Dream to control: Learning behaviors by latent imagination","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.329614Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:7d4f2f21bed79a939b83e93354d247c16c8b6e0e6d2b1465debe9083a77f1988","observation_id":"43d21c00-7ba7-49f9-8db7-404214769029","resolution":{"observed_at":"2026-08-08T15:14:22.329614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.227086Z","title":"Phasic policy gradient","venue":null,"work_id":"0dee2000-9dfd-45c3-8617-d8f05ffaf7d2","year":2020},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.317687Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:1c5e89bc21ca0b5761d2317203c569b3d294128ec5a82436f10ca33ab985f261","observation_id":"3707742c-cdc3-4651-bb08-faee1c8943ea","resolution":{"observed_at":"2026-08-08T15:14:23.230309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-08-13T12:06:46.989903Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06114","snapshot_observed_at":"2026-08-08T15:14:22.467323Z","title":"Learning interactive real-world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.467323Z"},"links":{"cited_paper":"/paper/2310.06114","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:7a5da44526df38b49f5315d2abe44af929547ed11a219c03e7ca3db32f5ad9e9","observation_id":"8906ac7b-4bc8-4044-a0a4-e84d29743b69","resolution":{"observed_at":"2026-08-08T15:14:22.467323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T15:14:23.216137Z","title":"https://iclr-blog-track.github.io/2022/03/25/ppo- implementation-details/","venue":null,"work_id":"932929d3-ae37-4072-872f-2175568793fe","year":2022},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.332656Z"},"links":{"citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:7ec586a5f45378f9c06b4e12e30666966db262c8a9fcb3dd8aaf59b0d2ceb491","observation_id":"6cb7b33f-d77e-4a22-8de2-168511b246ed","resolution":{"observed_at":"2026-08-08T15:14:23.220035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-14T11:08:32.950294Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-08T15:14:22.347722Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.347722Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:ae48899daeceb29ef596c677f9710c06351c15a5e276812ff98312db7934d2e2","observation_id":"9856ffde-2b26-4825-8889-93ed73b16072","resolution":{"observed_at":"2026-08-08T15:14:22.347722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12399","last_updated":"2024-10-30T14:34:49Z","snapshot_observed_at":"2026-08-14T15:15:36.460473Z","submitted_at":"2024-05-20T22:51:05Z","title":"Diffusion for World Modeling: Visual Details Matter in Atari","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12399","snapshot_observed_at":"2026-08-08T15:14:22.229876Z","title":"Mohammad Babaeizadeh, Mohammad Taghi Saffar, Suraj Nair, Sergey Levine, Chelsea Finn, and Dumitru Erhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T15:14:22.229876Z"},"links":{"cited_paper":"/paper/2405.12399","citing_paper":"/paper/2502.07825"},"observation_digest":"sha256:d0b97b4e19a80c0a0058d23e27db6167d7ea9272185d14488e5db1f12e83be7f","observation_id":"6873f18a-cb3b-4ab8-bc41-9480163c524d","resolution":{"observed_at":"2026-08-08T15:14:22.229876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07825","last_updated":"2025-02-10T14:49:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T03:49:35.814437Z","submitted_at":"2025-02-10T14:49:09Z","title":"Pre-Trained Video Generative Models as World Simulators"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 17 inbound Pith citation observations for arXiv:2502.07825."}