{"as_of":"2026-08-16T17:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5fc28fba1dfd91ba6c129e5e8898bb9580ff4d3b1a76e065909bcf25d0326d24","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:58:58.492878Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:31:52.984933Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T17:51:54.796433Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-08-10T18:31:52.984933Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-16T09:13:51.664817Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"reference_index":223,"source":"pdf_text","source_observed_at":"2026-08-10T18:31:52.984933Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2501.11260"},"observation_digest":"sha256:f3e158d5b7a4a42f80e7684c7439cbdd48392c7f62db6f84cb534788771364e9","observation_id":"41ebb73c-9c33-49a7-98e5-dd8f28167298","resolution":{"observed_at":"2026-08-10T18:31:52.984933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":"2412.08410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physical informed driving world model","venue":null,"work_id":"77ea2101-2312-4533-b0c9-e883a7aa5f24","year":2024},"citing_paper":{"arxiv_id":"2504.18576","last_updated":"2026-04-24T20:54:23Z","snapshot_observed_at":"2026-08-12T12:55:11.631209Z","submitted_at":"2025-04-22T20:58:22Z","title":"DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T17:50:59.797593Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2504.18576"},"observation_digest":"sha256:788091bb85042c0d805b865e9adeb7d71dec0bf1497fd317195f616fa08768b9","observation_id":"3afa36f0-f4de-441e-aba1-ea4e330d1edf","resolution":{"observed_at":"2026-05-22T17:51:54.799714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-08-04T20:52:06.587203Z","title":"Pys- ical informed driving world model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08302","last_updated":"2025-09-10T05:45:49Z","snapshot_observed_at":"2026-08-10T20:10:45.612509Z","submitted_at":"2025-09-10T05:45:49Z","title":"Foundation Models for Autonomous Driving Perception: A Survey Through Core Capabilities","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-04T20:52:06.587203Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2509.08302"},"observation_digest":"sha256:278713961c6c488e63fb39e957f8a1fa02a3fedb4d31450cae5f70cc202ecdfe","observation_id":"24f0798c-92af-4e58-bc33-13b694187851","resolution":{"observed_at":"2026-08-04T20:52:06.587203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-08-04T09:12:54.374022Z","title":"Physical informed driving world model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.16732","last_updated":"2026-06-25T19:54:02Z","snapshot_observed_at":"2026-08-12T21:04:24.441891Z","submitted_at":"2025-10-19T07:12:32Z","title":"A Comprehensive Survey on World Models for Embodied AI","version":3},"reference_index":214,"source":"pdf_text","source_observed_at":"2026-08-04T09:12:54.374022Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2510.16732"},"observation_digest":"sha256:d25fdf6f90e950ab9a6d28f66e468c8cee3c9175d1924e235b9948545a3f8c56","observation_id":"2c5cbbd6-3523-43cc-a13a-25dbb91d6b98","resolution":{"observed_at":"2026-08-04T09:12:54.374022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-08-03T17:02:42.473873Z","title":"Physical informed driving world model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10958","last_updated":"2026-06-01T17:54:44Z","snapshot_observed_at":"2026-08-13T02:06:13.721301Z","submitted_at":"2025-12-11T18:59:58Z","title":"WorldLens: Full-Spectrum Evaluations of Driving World Models in Real World","version":2},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-08-03T17:02:42.473873Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2512.10958"},"observation_digest":"sha256:92313933f906b5df9520869a920a49415f87010262a8e991b3b1ecbb232d3c8d","observation_id":"a03e8934-99c5-43f2-bf1e-d4066f579245","resolution":{"observed_at":"2026-08-03T17:02:42.473873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"cited_work":{"arxiv_id":"2412.08410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08410","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physical informed driving world model","venue":null,"work_id":"77ea2101-2312-4533-b0c9-e883a7aa5f24","year":2024},"citing_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-08-11T21:17:05.183857Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:11.514186Z"},"links":{"cited_paper":"/paper/2412.08410","citing_paper":"/paper/2604.18564"},"observation_digest":"sha256:e0542af7ff7d54a9723842a6368950b96029baee8f9cfa37446e897a134448f1","observation_id":"dabfd1d9-faf5-4c98-aa6b-3507fe97cfca","resolution":{"observed_at":"2026-05-10T10:09:08.093011Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.08410/citation-record","integrity":"/paper/2412.08410/integrity","json":"/paper/2412.08410/citation-record.json","paper":"/paper/2412.08410"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-16T15:39:48.920549Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-11T17:58:58.286202Z","title":"Latent-shift: Latent diffu- sion with temporal shift for efficient text-to-video genera- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.286202Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:ab7658bc04f093223993888fd4fcc9cbb53f58721b7a65bdd7bc257b9e297ebf","observation_id":"4b85c0c5-43be-41c7-b032-495d5ca1f6dd","resolution":{"observed_at":"2026-08-11T17:58:58.286202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-16T12:52:49.101262Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-11T17:58:58.291656Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.291656Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:1a6b1f36415d8bceefe9d284deafe025e96766cfb7aa34105067b860aeae0375","observation_id":"75343fff-0023-4f32-94c7-0de5bcc45895","resolution":{"observed_at":"2026-08-11T17:58:58.291656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.119734Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"d83f310c-2d02-436b-b834-cc4d341c40f0","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.296448Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:5d5f88950498dbefde4451c991d7df251905baf0071b055798f26f5701309863","observation_id":"5ea56432-d879-4eff-9285-8c966f4918e2","resolution":{"observed_at":"2026-08-11T17:58:59.124634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-08-11T17:58:58.301381Z","title":"Vir- tual kitti 2","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.301381Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:abdbb6d5e6d4fda48745a9c5f297104db69db5cb32f3baf5ad0603ffcca2190e","observation_id":"987239e9-29b5-4c09-826a-43275ec99950","resolution":{"observed_at":"2026-08-11T17:58:58.301381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.106864Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"97dc7cf3-1f95-471f-954b-16bd304c4e0b","year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.306570Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:9474951e3b7745b48fe97f9896b1effe117720b443ae0017a9844bf41c5edaae","observation_id":"a0521e8f-14e0-49c9-8f01-6c981d7c9f8d","resolution":{"observed_at":"2026-08-11T17:58:59.111242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.092467Z","title":"CARLA: An open urban driving simulator","venue":null,"work_id":"aaf34595-55e4-47f0-b7d6-b8ec055c6345","year":2017},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.311038Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:064e6fdc227e7ae3d7fe4a0af8dca5a807fd006fa1870f9cdff707f0c58b26f2","observation_id":"1d4b8f78-ef90-42aa-bc7f-c1477707f121","resolution":{"observed_at":"2026-08-11T17:58:59.097512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.078069Z","title":"Magicdrive: Street view generation with diverse 3d geometry control","venue":null,"work_id":"53639c1b-4691-4f31-9708-731f8b3f168c","year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.315655Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:dec37e733aebf1d01231ec65918b4f61c7207e6702cc406b264cfe917dfe2ca7","observation_id":"b98e65e1-a64d-4f98-b560-91243918a682","resolution":{"observed_at":"2026-08-11T17:58:59.082815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.064670Z","title":"Gan-based virtual- to-real image translation for urban scene semantic segmen- tation","venue":null,"work_id":"cc5723de-f833-4676-9e86-8090e696ac37","year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.319643Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:cbec2e0880c8f1d83e2280d9b81d9470c1b02e5c4f8b378f2a366b8dc03f5d3d","observation_id":"03fda73b-3a78-451d-aa1d-89884b150742","resolution":{"observed_at":"2026-08-11T17:58:59.069599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.050406Z","title":"Learning video rep- resentations of human motion from synthetic data","venue":null,"work_id":"3703b17b-1122-4de4-b273-c35ac66cd32a","year":2022},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.324204Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:45c961b1f7f82c49af941c81fd72d175f62e0e1b449d3fc2e8563be986e5dfa9","observation_id":"f02bec2d-0df7-47cb-93b1-e0cb677f3d8b","resolution":{"observed_at":"2026-08-11T17:58:59.055054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-11T17:58:58.328661Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.328661Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:18dffd06a30a3a90331845ebe77cf447dbda730c72d797856f5c45237d31cc66","observation_id":"18ab6450-a9f5-4acb-9073-c03814939a8e","resolution":{"observed_at":"2026-08-11T17:58:58.328661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-13T08:59:59.906684Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-11T17:58:58.332946Z","title":"Latent video diffusion models for high-fidelity video generation with arbitrary lengths","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.332946Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:c1f439c585c1bf189fe12bd5ebb43c687d5719632fddaeec2de43d365c5e6556","observation_id":"ab10fe61-4f49-4b5e-bdc9-be30527bf3b3","resolution":{"observed_at":"2026-08-11T17:58:58.332946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.038070Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"007dac29-5dde-4d5a-8c79-b8dd49c90933","year":2017},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.337261Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:67e7c1ddaf105f501e4ba7571936e869c55fa2df968a314b069b73baf9b3080c","observation_id":"570188ec-28e4-48cd-a558-2dc92374c107","resolution":{"observed_at":"2026-08-11T17:58:59.042253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.023993Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"9ea8a012-0708-4fc9-a813-1eb05c84ba54","year":2021},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.341410Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:cb446df389fe98dc9f0acaec00f9e0f2e510a88aa80162c175dc1070f89207f0","observation_id":"f08eac2d-9bd4-47e3-9412-e15a8629f442","resolution":{"observed_at":"2026-08-11T17:58:59.028635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.345291Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.345291Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:84ef4cbfea5cf1684c2bc664fafabe0e2fd30314130571234c930f0cdb215c3c","observation_id":"1fd1a30d-f4a4-4914-a1ab-7d9d60b7dff3","resolution":{"observed_at":"2026-08-11T17:58:58.345291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T17:58:58.349163Z","title":"Imagen video: High definition video generation with diffusion mod- els","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.349163Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:af6b6aa6924e4b181607f192397c123372529d53f466977f1e569a4836424435","observation_id":"cf78aa91-1a4e-4d1e-9d16-020a886fe525","resolution":{"observed_at":"2026-08-11T17:58:58.349163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13549","last_updated":"2023-11-22T17:44:29Z","snapshot_observed_at":"2026-08-16T14:41:05.891700Z","submitted_at":"2023-11-22T17:44:29Z","title":"ADriver-I: A General World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13549","snapshot_observed_at":"2026-08-11T17:58:58.353543Z","title":"Adriver-i: A general world model for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.353543Z"},"links":{"cited_paper":"/paper/2311.13549","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:b440cde26956947bfe2ddd00a63ab4189d862abc2c6202737b35bdc6475d0c92","observation_id":"e682f2e9-29f4-4a09-b41d-33420f9fc021","resolution":{"observed_at":"2026-08-11T17:58:58.353543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:59.003203Z","title":"Drivingdiffu- sion: Layout-guided multi-view driving scene video gener- ation with latent diffusion model, 2023","venue":null,"work_id":"11b33a21-1492-4ce1-9d18-8f8e75a5eecb","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.357846Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:5114421d73d9db2c4af8effb8408279f82b4d56ef58f4b12affb1eb6846977b5","observation_id":"3732d6b9-4e17-47fa-b897-4dabdc7a8d15","resolution":{"observed_at":"2026-08-11T17:58:59.007453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.989940Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"aef41573-7511-4976-86b5-2ed67702d4bd","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.361557Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:69765916ecbb8725e6bb71aed986e03a73f32fbc71adcc1bb19874a4ebfdfc7a","observation_id":"756cf46a-6078-4185-9a99-6265064ede36","resolution":{"observed_at":"2026-08-11T17:58:58.994439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.975867Z","title":"Wovogen: World volume-aware diffusion for con- trollable multi-camera driving scene generation, 2024","venue":null,"work_id":"34a7e829-b821-4903-97e9-9227c4d563d9","year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.365871Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:41d173de987038673a81add958c6282ab395d15ff17369b6af12292a8f7ec572","observation_id":"935c05c4-bc57-4ca6-ae59-9fc8f3096eb2","resolution":{"observed_at":"2026-08-11T17:58:58.980598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.962558Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":"9d600e88-aedb-4c39-b031-f3bed0f3c0c6","year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.369874Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:f6cb29a75d2bc1e72a2bd4c672c034e534e8228b25beaae2c1698826a76344b0","observation_id":"fc67a0b2-7b4b-4fc6-8331-72b88f1c2bf3","resolution":{"observed_at":"2026-08-11T17:58:58.967463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.373643Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.373643Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:c9d8fe3ae9507b824d3652ae4dcdb923515b34892fae183649c37a3aa8bfddd8","observation_id":"fe44afa6-d804-46f2-adda-0e2d06dfbf58","resolution":{"observed_at":"2026-08-11T17:58:58.373643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-11T17:58:58.377429Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.377429Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:b360d7b810b066ee463aa1c992dd16a8ccfd4400dcf983ccbde54b301a672424","observation_id":"7c6fbc32-7cfd-4b7d-9b09-51467ffa4ebb","resolution":{"observed_at":"2026-08-11T17:58:58.377429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.940928Z","title":"Exploring the limits of transfer learning with a uni- fied text-to-text transformer","venue":null,"work_id":"fb57c856-e366-4bec-b9e0-93440ca390ee","year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.381250Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:6e8f3d3ed78c1fbda0f2eb9ae73895dd1285148bec57bbb533b9cd04423ffaf3","observation_id":"000271a3-7cdf-48c8-8fd4-d4982ba29049","resolution":{"observed_at":"2026-08-11T17:58:58.945335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T17:58:58.384644Z","title":"Hierarchical text-conditional im- age generation with clip latents, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.384644Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:2aebf2dc9bb82913860b7d4c52a9e2917d83bc776cd0dcce518343598a17426b","observation_id":"91ff9ac6-cfd6-4cd7-b9cd-09546e831195","resolution":{"observed_at":"2026-08-11T17:58:58.384644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.388465Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.388465Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:a17d9291609f45c3c82a7cafdb68ee27d154c92fec0f600ceef78c869f87c68f","observation_id":"a36f5579-6f58-457f-a3e9-6b94fb7e4cb1","resolution":{"observed_at":"2026-08-11T17:58:58.388465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.920009Z","title":"The synthia dataset: A large collection of synthetic images for semantic segmentation of urban scenes","venue":null,"work_id":"a1707800-0f50-4dee-858c-842742a8a9ae","year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.391900Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:fb68ebc52eabce6303dbf52a2fc46d604a17e770ef876724cca87129ca14bf88","observation_id":"148fed5e-2a00-4fef-994d-477f64264158","resolution":{"observed_at":"2026-08-11T17:58:58.924702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.907639Z","title":"Uniad: A unified ad hoc data processing system.ACM Trans- actions on Database Systems (TODS), 42(1):1–42, 2016","venue":null,"work_id":"43e397bf-aac7-40f4-876e-bfe12aa1f06e","year":2016},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.396122Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:d43e691316fc43b0b4e7888d2a13e1ed141b40472f470246c40d612ec4bdc67f","observation_id":"4482455a-6548-4333-9044-ee7eb77ee734","resolution":{"observed_at":"2026-08-11T17:58:58.911860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.895677Z","title":"Learning 12 from simulated and unsupervised images through adversarial training","venue":null,"work_id":"842bfa07-947e-4001-a8c7-66b592ddf17b","year":2017},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.399608Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:d9ba8a4102173768493415d8d1d1fa61936c2a506c5ea0431a02f15c69413ead","observation_id":"ba0116da-ad7c-4838-918a-474525c11b6a","resolution":{"observed_at":"2026-08-11T17:58:58.899709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-11T17:58:58.403342Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.403342Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:17712a64658fd33447b428371f827e725f4261842473ca4a961e1463948b6f0e","observation_id":"29c9a3a0-48ed-415d-b8bb-71af4b71e4b5","resolution":{"observed_at":"2026-08-11T17:58:58.403342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.407998Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.407998Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:ac8a10f7fc847e0dda289369a8fd3625edd1696e9dc71f76b562b49ed7400c25","observation_id":"f4eafede-498a-4c98-ab1a-c614d33a7628","resolution":{"observed_at":"2026-08-11T17:58:58.407998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04634","last_updated":"2024-02-13T06:21:11Z","snapshot_observed_at":"2026-08-16T16:03:02.712803Z","submitted_at":"2023-01-11T18:39:34Z","title":"Street-View Image Generation from a Bird's-Eye View Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04634","snapshot_observed_at":"2026-08-11T17:58:58.411831Z","title":"Street- view image generation from a bird’s-eye view layout","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.411831Z"},"links":{"cited_paper":"/paper/2301.04634","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:50d5674c5140facf2208c6f2a8c6e0ce6adff34091cb96d8f300916721d78b6a","observation_id":"76aa1697-7fa0-4fbc-a1c7-4b5ac5bd28c3","resolution":{"observed_at":"2026-08-11T17:58:58.411831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01097","last_updated":"2023-12-25T04:32:26Z","snapshot_observed_at":"2026-08-16T15:19:07.073056Z","submitted_at":"2023-07-03T15:19:17Z","title":"MVDiffusion: Enabling Holistic Multi-view Image Generation with Correspondence-Aware Diffusion","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01097","snapshot_observed_at":"2026-08-11T17:58:58.416036Z","title":"Mvdiffusion: Enabling holistic multi- view image generation with correspondence-aware diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.416036Z"},"links":{"cited_paper":"/paper/2307.01097","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:0257a7ccfe39b2dead8c85996a31a904900e32d10575bb1728692670d2074dc5","observation_id":"043a437b-8ece-492d-9f88-e875ab79b733","resolution":{"observed_at":"2026-08-11T17:58:58.416036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.419800Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.419800Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:18588b5018a9c51077442170968d0f4540193183ca5af77f5c9764e249991851","observation_id":"90dfeb38-14e8-42b5-8ec6-0ab6ae84e8cf","resolution":{"observed_at":"2026-08-11T17:58:58.419800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.867752Z","title":"Consistent view synthesis with pose-guided diffusion models","venue":null,"work_id":"6aab1e64-256e-4027-a610-fcb965de9572","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.423768Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:e5e4217b6bdc0192a0b12d6470ac3df636d2e72818734b833f16603473f8ffcc","observation_id":"00f8a4eb-a254-474f-847c-7390af8597c4","resolution":{"observed_at":"2026-08-11T17:58:58.871909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-15T00:26:15.250313Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T17:58:58.427881Z","title":"To- wards accurate generative models of video: A new metric challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.427881Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:8c8e0a74cee0b3a79d72471bba8717c4f59f511119520fa8362618cda6123a73","observation_id":"9fd47125-8eb4-4303-9e66-2585f4993afe","resolution":{"observed_at":"2026-08-11T17:58:58.427881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.856175Z","title":"Attention is all you need","venue":null,"work_id":"cc49fa5b-15f9-46bc-84f7-02e97c9adc69","year":2017},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.432062Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:a951d9c725d6e4b386efe8bce671c6b58c0d03b57a490e62ad66d5852fd2fbe2","observation_id":"49bfcf36-bfed-4090-9e16-ab534fe517e0","resolution":{"observed_at":"2026-08-11T17:58:58.859969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.843092Z","title":"Exploring object-centric temporal modeling for efficient multi-view 3d object detection","venue":null,"work_id":"3be107ef-ad66-492f-a1f7-fff95a23fe82","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.436030Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:12ad07291059c7266fd993bea6811869667ff8eaec4a0ca2dfd19a04755f4138","observation_id":"4e491b20-097c-4473-b511-1ea4fa851230","resolution":{"observed_at":"2026-08-11T17:58:58.847896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.830068Z","title":"Videofactory: Swap at- tention in spatiotemporal diffusions for text-to-video gener- ation, 2023","venue":null,"work_id":"0caca48a-166a-4481-8a8a-5f746026091f","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.439999Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:36d483ddbe0f2739065d1cab4e4175db678ad621b92f40fcf0fb0f16d4371077","observation_id":"430b276b-b838-4d2e-85ad-6320e44c9131","resolution":{"observed_at":"2026-08-11T17:58:58.834623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-08-16T14:59:48.218608Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-11T17:58:58.444090Z","title":"Drivedreamer: Towards real-world- driven world models for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.444090Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:991d884461937e5997cb6c97aff5d3ce707ed422cffa8a7b6f157dacb53248e6","observation_id":"892263d8-6b64-47c9-a70a-6e8de63377f7","resolution":{"observed_at":"2026-08-11T17:58:58.444090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.817133Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving, 2023","venue":null,"work_id":"fcf56063-5b2e-4cf2-896d-f594d1aaba8f","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.447595Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:1adb27d648e33e2d724839c2e5288a0a6e30afcafcf4bc5fe9ed5d57da81ad55","observation_id":"d2a94574-c5cc-4af1-8eea-8bde469010f2","resolution":{"observed_at":"2026-08-11T17:58:58.821545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.804441Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving","venue":null,"work_id":"dcb95dfb-e01b-4224-9edc-43f8156390e0","year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.451136Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:c4b6ad43285ff8ab4f14ac9fde64e22a06e7404273e8871418c3d51dd09f661c","observation_id":"b72f2ca1-c71f-4fd6-923e-f1fbfb03b7b2","resolution":{"observed_at":"2026-08-11T17:58:58.808701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-16T15:11:06.034826Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-11T17:58:58.455339Z","title":"Bevcontrol: Accurately controlling street- view elements with multi-perspective consistency via bev sketch layout","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.455339Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:d0352a157f8ca2cb7593e6d13a532bc09bf0ecf8968d5a676e43cedd12d2bdf0","observation_id":"9d3a015a-af50-402d-b044-4a7af83a78b3","resolution":{"observed_at":"2026-08-11T17:58:58.455339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.792267Z","title":"Magvit: Masked generative video transformer","venue":null,"work_id":"4fe840b0-fa8c-4f20-86e4-c35feb85ba62","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.459666Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:908b78a47d64bc83e50f0bd7a3995b9de034bdee14af15f7c5b95fe5576a801c","observation_id":"eb4378b4-cb85-42ff-b4b1-7f2dbfaecf36","resolution":{"observed_at":"2026-08-11T17:58:58.796348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.779629Z","title":"Moonshot: To- wards controllable video generation and editing with multi- modal conditions, 2024","venue":null,"work_id":"19d19bf9-53e4-4470-b19e-fe960f0422b4","year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.463513Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:a5172089ef8c5cb2829279e36e4734274714fb1ddfcd6b7def50a8afa5295487","observation_id":"88a19d93-3bd4-4807-9d47-24f40d1aadb2","resolution":{"observed_at":"2026-08-11T17:58:58.783763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.467551Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.467551Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:5f99b521d1eefc577dd6b20cc18ac7387fc6ccc44d0caa31635c642e6bdfeb4b","observation_id":"85472ba3-cd49-4454-86d6-6f450f65df25","resolution":{"observed_at":"2026-08-11T17:58:58.467551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.760187Z","title":"Collaborative and adversarial network for unsupervised do- main adaptation","venue":null,"work_id":"294cd131-714c-4f43-b30f-48c9eeef663c","year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.471434Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:36c612ef28aa62d71454acc896d15bf5fa18b2aaa0a5535b735825adc5840de4","observation_id":"d760a2ca-8a8a-463e-999a-4977e19d6fc3","resolution":{"observed_at":"2026-08-11T17:58:58.764198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-16T14:10:55.463304Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-11T17:58:58.475852Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.475852Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:61183ce1240a66f9e9ec03caffc10f54c20344cd3d25b2eff558965175d387ef","observation_id":"4b2863e2-328f-4295-9fad-e79343f57c3b","resolution":{"observed_at":"2026-08-11T17:58:58.475852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11502","last_updated":"2024-04-07T02:42:27Z","snapshot_observed_at":"2026-08-16T14:17:38.976140Z","submitted_at":"2024-02-18T08:21:05Z","title":"GenAD: Generative End-to-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11502","snapshot_observed_at":"2026-08-11T17:58:58.480102Z","title":"Genad: Generative end-to-end au- tonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.480102Z"},"links":{"cited_paper":"/paper/2402.11502","citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:86d0c762282f7fa5a846f93c39ccac4c3d3094af6ded21653e78d2b985948dbb","observation_id":"3768ceed-6242-4fd5-851f-519b592fb326","resolution":{"observed_at":"2026-08-11T17:58:58.480102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.747711Z","title":"Open-sora: Democratizing efficient video production for all, 2024","venue":null,"work_id":"c539dc9a-47d0-46e7-8c3c-b176b9ff741b","year":2024},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.484128Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:3853462e2db551d8a2676379a0baaa97361184bbfca7692bb9d5ba94d6feb57a","observation_id":"bd638ff6-3a72-44aa-a7ac-bd090241bf8c","resolution":{"observed_at":"2026-08-11T17:58:58.752042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.733537Z","title":"patchified","venue":null,"work_id":"3d894457-5023-4ed6-90d7-942cd5563e25","year":2023},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.488155Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:005c70b4fabf32f2a63f478216598a9f7b66c79e37e71d3b1fb8f360c8f14102","observation_id":"16d0aac3-1ead-4981-b815-6823e7a80c92","resolution":{"observed_at":"2026-08-11T17:58:58.738519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:58:58.718422Z","title":"Simulation-to-Real Visual Translation","venue":null,"work_id":"44ba1cc9-e2f0-40da-a49f-38f3c88179bc","year":null},"citing_paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T17:58:58.492878Z"},"links":{"citing_paper":"/paper/2412.08410"},"observation_digest":"sha256:8a497e079abe9def6e764bf7e0f3c33d5e182b8d83b125db29786f13c00aece7","observation_id":"35f79062-b189-47a1-960b-f48e0bd19b09","resolution":{"observed_at":"2026-08-11T17:58:58.724458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08410","last_updated":"2024-12-13T02:05:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T22:54:45.654500Z","submitted_at":"2024-12-11T14:29:35Z","title":"Physical Informed Driving World Model"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 6 inbound Pith citation observations for arXiv:2412.08410."}