{"as_of":"2026-08-14T13:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ccd8392f9226352a92654ae8adfee50273104b838f5d69734c84992915538d17","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:19:32.259571Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:57:19.282237Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T07:41:15.133064Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-08-04T08:57:19.282237Z","title":"World4drive: End-to-end au- tonomous driving via intention-aware physical latent world model.arXiv preprint arXiv:2507.00603, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-06T20:20:34.094359Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.282237Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2510.18313"},"observation_digest":"sha256:be893f32a4feaf7b97b2e85b3a2fea33a66f218cbdbbc28d24daea859a87b3bb","observation_id":"1bad7dc3-c9fd-4f6f-95c5-e457e6acf8c8","resolution":{"observed_at":"2026-08-04T08:57:19.282237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2604.18564","last_updated":"2026-04-21T06:41:18Z","snapshot_observed_at":"2026-08-11T21:17:05.183857Z","submitted_at":"2026-04-20T17:52:15Z","title":"MultiWorld: Scalable Multi-Agent Multi-View Video World Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-10T05:06:11.514186Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2604.18564"},"observation_digest":"sha256:7d26b07f66741ecd133cf9408da1f7091deb2464d058938d2a92fd38e969ee26","observation_id":"d74bd310-6264-4902-b8a1-542f03462abe","resolution":{"observed_at":"2026-05-10T10:09:08.267982Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.19631","last_updated":"2026-05-19T10:12:01Z","snapshot_observed_at":"2026-08-07T15:23:28.953160Z","submitted_at":"2026-05-19T10:12:01Z","title":"HEAT: Heterogeneous End-to-End Autonomous Driving via Trajectory-Guided World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T04:53:31.033435Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.19631"},"observation_digest":"sha256:e4b39654c142a3543afbaa3d3c2a3fcc852c9e011fe99a5f45a3f1a229fa1db5","observation_id":"fb12a3b3-edb1-4212-b1f5-8d1ba74e5a4e","resolution":{"observed_at":"2026-05-20T04:58:05.378019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.22089","last_updated":"2026-05-21T07:31:49Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T07:31:49Z","title":"LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T07:37:11.292270Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.22089"},"observation_digest":"sha256:dcf39ba3da03087b012513e63a0e3ff492f6fb450ec067434575657b83135aae","observation_id":"fbd15da8-b747-470f-ab19-c2770d77a4d6","resolution":{"observed_at":"2026-05-22T07:41:15.136172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":"2507.00603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World4drive: End-to-end autonomous driving via intention-aware physical latent world model.ArXiv, abs/2507.00603","venue":null,"work_id":"0560de60-63b0-402a-8674-64c8f388bded","year":2025},"citing_paper":{"arxiv_id":"2605.22456","last_updated":"2026-05-21T13:20:51Z","snapshot_observed_at":"2026-08-14T03:13:58.987093Z","submitted_at":"2026-05-21T13:20:51Z","title":"Steins;Gate Drive: Semantic Safety Arbitration over Structured Futures for Latency-Decoupled LLM Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T05:39:56.299842Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2605.22456"},"observation_digest":"sha256:42be0cd1d5b710c6654edc6b94343396ea4be6625bfe09118d36d093a306881a","observation_id":"dafd4fd8-97c0-458b-bb51-2e0855007bc7","resolution":{"observed_at":"2026-05-22T05:41:08.304980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00603","snapshot_observed_at":"2026-08-02T05:26:07.155612Z","title":"World4drive: End-to-endautonomousdrivingviaintention-awarephysical latent world model.arXiv preprint arXiv:2507.00603, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16314","last_updated":"2026-07-15T00:58:45Z","snapshot_observed_at":"2026-08-07T02:32:13.619549Z","submitted_at":"2026-07-15T00:58:45Z","title":"Depth-Regularized JEPA World Models Learn More Transferable Representations from Real Outdoor Robot Data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:26:07.155612Z"},"links":{"cited_paper":"/paper/2507.00603","citing_paper":"/paper/2607.16314"},"observation_digest":"sha256:5845e694b2b9869b98175b8be26580fc3ed111e3d328b9a7defd78abc21d09a9","observation_id":"494a20fd-e69d-45db-9f83-7cc66dacf5fa","resolution":{"observed_at":"2026-08-02T05:26:07.155612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00603/citation-record","integrity":"/paper/2507.00603/integrity","json":"/paper/2507.00603/citation-record.json","paper":"/paper/2507.00603"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.15672","last_updated":"2025-02-21T18:56:02Z","snapshot_observed_at":"2026-08-13T04:44:00.014879Z","submitted_at":"2025-02-21T18:56:02Z","title":"VaViM and VaVAM: Autonomous Driving through Video Generative Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15672","snapshot_observed_at":"2026-08-06T21:19:28.485169Z","title":"Vavim and vavam: Autonomous driving through video gen- erative modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.485169Z"},"links":{"cited_paper":"/paper/2502.15672","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:7defdfb3bb3e893662f4d1ed5aa0b7239d2e8f8e71156b455e401ee4c409a6d8","observation_id":"eaa5fb24-5ed8-48a9-bf5f-1e51a0fa7e99","resolution":{"observed_at":"2026-08-06T21:19:28.485169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.400759Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"e895d99a-1d34-4eab-b524-2bd3d4d74467","year":2020},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.552086Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9a7b8c9e494abbb7bd7a931548530ed2cbfee6b129a41e8ef65220eab2f97013","observation_id":"74ee6551-9412-4f04-9125-82fb894a30ac","resolution":{"observed_at":"2026-08-06T21:19:37.456134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-08-06T21:19:28.630401Z","title":"Vadv2: End-to-end vectorized autonomous driving via probabilistic planning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.630401Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:35898b95bd06f0db03afc19180c6581a5735c1986e4c4cd5225d5053a8438d28","observation_id":"68783d80-a1f9-4d0a-9f13-411aabfcee6a","resolution":{"observed_at":"2026-08-06T21:19:28.630401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.287326Z","title":"Ppad: Iterative interactions of prediction and planning for end-to-end autonomous driving","venue":null,"work_id":"e27ad75e-61f4-40c1-a000-62b5b4ef6b25","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.710796Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:0c649cf96c1a8e8a9781b06416379c455959b35cb3707aefca3847bf8df96014","observation_id":"8bcc522b-9329-4391-82ab-5c63a4a46ec4","resolution":{"observed_at":"2026-08-06T21:19:37.331104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.185453Z","title":"Openscene: The largest up-to- date 3d occupancy prediction benchmark in autonomous driving","venue":null,"work_id":"f94d740d-6c1f-45a6-8816-5228030e5b19","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.754600Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:81c12f0bdcbff7dd67dd9880ead0434283950898babf34484f1fbfbfe4f505d3","observation_id":"264d854e-769e-4216-b3f1-451208352558","resolution":{"observed_at":"2026-08-06T21:19:37.231874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17398","last_updated":"2024-10-28T05:53:17Z","snapshot_observed_at":"2026-08-13T03:00:17.299004Z","submitted_at":"2024-05-27T17:49:15Z","title":"Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17398","snapshot_observed_at":"2026-08-06T21:19:28.847600Z","title":"Vista: A generalizable driving world model with high fidelity and versatile controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.847600Z"},"links":{"cited_paper":"/paper/2405.17398","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:1e81ce45852e263f671edfe025e371e03e0945221220560aec0ee45af141fdda","observation_id":"7a7430b1-a84f-4c71-8a4d-8924bde0988b","resolution":{"observed_at":"2026-08-06T21:19:28.847600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10429","last_updated":"2024-10-14T12:24:32Z","snapshot_observed_at":"2026-08-14T03:07:23.296914Z","submitted_at":"2024-10-14T12:24:32Z","title":"DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10429","snapshot_observed_at":"2026-08-06T21:19:28.914725Z","title":"Dome: Tam- ing diffusion model into high-fidelity controllable occupancy world model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:28.914725Z"},"links":{"cited_paper":"/paper/2410.10429","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:6fca189c0e962db7d825aedad4d2f9199fcdbfb161f066c15689439f76e2cc92","observation_id":"7e9a3492-fd7b-4a7f-a38c-7bb133eceb70","resolution":{"observed_at":"2026-08-06T21:19:28.914725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:37.048740Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"46510e42-ec2b-4c10-a4a3-69987eccf53c","year":2016},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.000610Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:100cd63577f6a5fb607a364ff7f42d9ff2722a368f13de72060ed76c596e40e1","observation_id":"fb96ad21-bb1c-4452-899e-43f308da5477","resolution":{"observed_at":"2026-08-06T21:19:37.123963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.948063Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"313e41d5-1dd1-484f-b834-9e15cc15d594","year":2020},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.088121Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:5f642adcc5bbd8ce17ee807a4ff8cc9da3cd0b5f0cc0ca704afad082282bcfe3","observation_id":"fcf4db1d-31d4-4616-a7ea-7b0ebf66ea57","resolution":{"observed_at":"2026-08-06T21:19:36.992525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T21:19:29.168385Z","title":"Gaia-1: A generative world model for au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.168385Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:78595dc5780a2d480bfdcb10cb3d5edbf26edb2c58bdf9c241e78a480cfe0ce4","observation_id":"13c980ee-1142-4a85-abbf-f07843dea237","resolution":{"observed_at":"2026-08-06T21:19:29.168385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.821958Z","title":"Metric3d v2: A versatile monocular geomet- ric foundation model for zero-shot metric depth and surface normal estimation","venue":null,"work_id":"ee059a57-81c0-471e-906e-438790ef279e","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.243697Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:e81292fd143265c0ce15bce0df942f70303924c21a9e9437e70b836165479615","observation_id":"17d354fa-5b82-4c15-a252-bd55ba34b179","resolution":{"observed_at":"2026-08-06T21:19:36.869266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.723671Z","title":"St-p3: End-to-end vision-based au- tonomous driving via spatial-temporal feature learning","venue":null,"work_id":"604a706f-c3a4-4ae6-b44d-4c2a5b3f70e8","year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.321885Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:695807e2734b7cbca5a3536ecbab68be69b324e09259cd2a614715b2adec0026","observation_id":"664e0aa8-7228-4829-b6fb-0fe5b637c82e","resolution":{"observed_at":"2026-08-06T21:19:36.765702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.611914Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"3a5f7539-49c9-490d-9756-13629a95c4d3","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.401745Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:5d12d25b68e2e8bc34e4a6dfb51fc494b9424a1af78cec8426c16417692a225e","observation_id":"bd7bcb25-a4ab-475a-bef3-822833a5900c","resolution":{"observed_at":"2026-08-06T21:19:36.653677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15349","last_updated":"2024-10-31T17:58:34Z","snapshot_observed_at":"2026-08-12T23:37:19.488787Z","submitted_at":"2024-06-21T17:59:02Z","title":"NAVSIM: Data-Driven Non-Reactive Autonomous Vehicle Simulation and Benchmarking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15349","snapshot_observed_at":"2026-08-06T21:19:29.501478Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.501478Z"},"links":{"cited_paper":"/paper/2406.15349","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:dad873d38ea54128eacdc03f9f8aefb74c620136baeca13c4a69269003606205","observation_id":"fcd41b05-1cd8-4c5d-a182-1e32e33d1bca","resolution":{"observed_at":"2026-08-06T21:19:29.501478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.453562Z","title":"Drivetransformer: Unified transformer for scalable end-to- end autonomous driving","venue":null,"work_id":"433e22bf-0be4-40e0-91c2-10f3ece76988","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.592046Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:eddae68c650b9688874dd6872d28d685ac4a394569ed2ee6855305b4bf3e344c","observation_id":"d1501d27-c461-4b6e-8f4a-91a4d422fcbb","resolution":{"observed_at":"2026-08-06T21:19:36.528619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.310625Z","title":"Vad: Vectorized scene representation for efficient autonomous driving","venue":null,"work_id":"357f4a0f-c6ef-4b7e-b9df-b38f7ae64e30","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.666510Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:2a86f9b355a8b457c41e60d0d08e7077c622f985183f6ff7bf21dc10af6f0987","observation_id":"49874fa3-e297-4d87-a191-1ce7a4f12f29","resolution":{"observed_at":"2026-08-06T21:19:36.373483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:36.171945Z","title":"Tod3cap: Towards 3d dense captioning in out- door scenes","venue":null,"work_id":"c8357808-6f26-4548-bc96-c6966c50e4e5","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.751803Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:32d131156ced61e28fe6dc9730acfa29209cb58c9a94eaf7a66f5a1a969ea5c1","observation_id":"cb38460e-e258-448e-aa38-ae591708b525","resolution":{"observed_at":"2026-08-06T21:19:36.242987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.995062Z","title":"Enhancing end-to-end au- tonomous driving with latent world model","venue":null,"work_id":"69b09181-da4c-4e45-9fa6-cc613f8016c7","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.861107Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:eed2a28e9fe821a80266881cc306709fb9e5ff1da93ed8ef651d7ea4d0191d45","observation_id":"c3023140-b71c-4257-9cf9-609842e5a61d","resolution":{"observed_at":"2026-08-06T21:19:36.092425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-08-06T21:19:29.947637Z","title":"Hydra-mdp: End-to-end multimodal planning with multi- target hydra-distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:29.947637Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:a9a24c91f64ac28ba2b2a38e9021e869b6a31660345d238a2a79eef99c0ee7d1","observation_id":"28b2a234-28c4-4704-8599-082f118ebb27","resolution":{"observed_at":"2026-08-06T21:19:29.947637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.849218Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers","venue":null,"work_id":"2a729a5c-e35f-40dc-b0c0-3d9ca0ae1254","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.030580Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:312906c2d001590f07fbb8bdb26c6b0d054c85cdcc9e36c88ac4374f2670dded","observation_id":"990e4bee-8798-4ad1-8b09-0c60b67f1f1b","resolution":{"observed_at":"2026-08-06T21:19:35.912066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.698733Z","title":"Is ego status all you need for open- loop end-to-end autonomous driving? In Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024","venue":null,"work_id":"733545ae-9ef5-4f57-add4-02acd190a69f","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.091560Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:0a82b833cf979cee6cca3046b5ad2555f0470318d268986c171c80031a616278","observation_id":"ac2e1a1c-f24f-4da5-92ad-730aa7f7acc7","resolution":{"observed_at":"2026-08-06T21:19:35.779898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14437","last_updated":"2023-01-30T02:39:49Z","snapshot_observed_at":"2026-08-13T14:35:51.952977Z","submitted_at":"2022-08-30T17:55:59Z","title":"MapTR: Structured Modeling and Learning for Online Vectorized HD Map Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14437","snapshot_observed_at":"2026-08-06T21:19:30.149583Z","title":"Maptr: Structured modeling and learning for online vectorized hd map construction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.149583Z"},"links":{"cited_paper":"/paper/2208.14437","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:3880c638b99c37189af0891ac8da3e079b787e06f5c99ab4eb83a71f7a070db2","observation_id":"d236a067-cfa1-41e8-99d6-0ce07717d53d","resolution":{"observed_at":"2026-08-06T21:19:30.149583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.559663Z","title":"Diffusiondrive: Trun- cated diffusion model for end-to-end autonomous driving","venue":null,"work_id":"e0bf1e14-a8a5-4710-9b0b-6222d1b74008","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.208857Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:45e100831b5590f30460aa2c839a0ac1ce6d561e676846aa404316f29e86e9a0","observation_id":"ca8ec8b8-6327-477e-b9f0-9745141ef45d","resolution":{"observed_at":"2026-08-06T21:19:35.650618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-14T06:47:51.637108Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:19:30.259711Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.259711Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:8b85d6c7c0bb4f1cd19f1c07bbe0ecc5d4338f1daab0172be2acafda79814828","observation_id":"76534d3f-2bfd-4c15-b5aa-f7dac4250ec9","resolution":{"observed_at":"2026-08-06T21:19:30.259711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.422894Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"65caea87-061d-4a33-82f2-a3d3a6171228","year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.332034Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:b84a9bbba2375f8eb670b7650275f709ada4aac7f52adf8ee982cc5d7db6c3d1","observation_id":"d195bb2a-8347-4b10-8281-9ed835417b9e","resolution":{"observed_at":"2026-08-06T21:19:35.492270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.262949Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"c31e4695-7f76-494c-9b27-8628bf25abb4","year":2021},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.421159Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:074b42985c5c7b3d55ec8843c2ecb88362d6886e4f68bfc2e0597188980ea2f0","observation_id":"2a5cb714-f320-4f94-98ba-e79b06a9255b","resolution":{"observed_at":"2026-08-06T21:19:35.355100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:35.113252Z","title":"Lingoqa: Visual question answering for autonomous driv- ing","venue":null,"work_id":"122f9f8b-b8e2-44c8-bf6b-858be70d3a31","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.505212Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:7c2f9a1ff7c0710f4df995e8ab0e91a87fbfea25e5aa1b34079daca7d36736a9","observation_id":"9b909651-8fea-40b4-ae17-ce48b2ae8421","resolution":{"observed_at":"2026-08-06T21:19:35.203112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.941036Z","title":"Driveworld: 4d pre-trained scene understanding via world models for autonomous driving","venue":null,"work_id":"6ffbc5e1-590d-4ae1-b4de-bf4eef1a9bbd","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.573785Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:329ff33912fb5b1c6fbfb8d7e6a0d1bf4e7ff6dcea732a3d18becff6b3b80ed3","observation_id":"7e8df97c-4e79-49fd-904d-cf8a60102460","resolution":{"observed_at":"2026-08-06T21:19:35.023310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.775292Z","title":"Vlp: Vision language planning for autonomous driving","venue":null,"work_id":"6f583cd5-4485-4a65-a968-3a41635e3e92","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.643565Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:81d4c03958d486f1232efa8d27e1097b50107915f54faac000c1ee25c5c36739","observation_id":"df0e6bfc-023b-4598-b321-e56357d95d2a","resolution":{"observed_at":"2026-08-06T21:19:34.859327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.632135Z","title":"Multi-modal fusion transformer for end-to-end autonomous driving","venue":null,"work_id":"26c012c5-9172-488c-9eaf-c687501717e1","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.689533Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:096fd69413a9f27aa4511b09d7625df07593d61af8f8c4a94914f927fe6e9257","observation_id":"47f24059-ce9a-4017-9994-a50d4b2fba34","resolution":{"observed_at":"2026-08-06T21:19:34.702738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T21:19:30.752490Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.752490Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:7202ce2cc25ac2f21da29f8e9e2f63c90c84d8864dfd4de87f32eaafdb15a8ad","observation_id":"c1f00341-6da6-49fc-83aa-d770a8d92902","resolution":{"observed_at":"2026-08-06T21:19:30.752490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.425726Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"bd36e482-2d93-44a4-acbd-b996c43fc7a5","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.825740Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ab14251fae9c2ae91d281528cf934ace713ac884911f4345cd55ae0ce93a8f16","observation_id":"fd73dddc-0de6-49e2-bb4a-e2d7d8e3b70a","resolution":{"observed_at":"2026-08-06T21:19:34.505505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19620","last_updated":"2024-05-31T07:40:55Z","snapshot_observed_at":"2026-08-12T23:54:39.984184Z","submitted_at":"2024-05-30T02:13:56Z","title":"SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19620","snapshot_observed_at":"2026-08-06T21:19:30.874272Z","title":"Sparsedrive: End-to-end au- tonomous driving via sparse scene representation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.874272Z"},"links":{"cited_paper":"/paper/2405.19620","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:3c9c259e029bfe7b9d8724b986a566c50cc87c1f00996eb30949293542c41c19","observation_id":"26ddc1ba-a5d9-43ea-9be1-873a8c795287","resolution":{"observed_at":"2026-08-06T21:19:30.874272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00959","last_updated":"2024-07-01T04:34:50Z","snapshot_observed_at":"2026-08-12T23:31:37.920667Z","submitted_at":"2024-07-01T04:34:50Z","title":"Tokenize the World into Object-level Knowledge to Address Long-tail Events in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00959","snapshot_observed_at":"2026-08-06T21:19:30.946025Z","title":"Tokenize the world into object-level knowledge to address long-tail events in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.946025Z"},"links":{"cited_paper":"/paper/2407.00959","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:9967decd713dbdc1b28a2286b4a094713a8880b4b9ae021e7329da32543e94b4","observation_id":"b3e99cc9-d179-489f-bba1-2a693627bbfe","resolution":{"observed_at":"2026-08-06T21:19:30.946025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12289","last_updated":"2024-06-25T17:55:35Z","snapshot_observed_at":"2026-08-13T08:07:31.942031Z","submitted_at":"2024-02-19T17:04:04Z","title":"DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12289","snapshot_observed_at":"2026-08-06T21:19:31.032780Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.032780Z"},"links":{"cited_paper":"/paper/2402.12289","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:d15a28bd353b5345896b3fd3b0e83c0574dffd01eaeb24d836e2df59b0826489","observation_id":"711c9425-4f87-455c-ac2f-31d5525982a5","resolution":{"observed_at":"2026-08-06T21:19:31.032780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.246559Z","title":"Scene as occupancy","venue":null,"work_id":"09967d44-355c-4aab-8785-0cb36045c64a","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.106173Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:1b58c19a6f72a1f8ae18d8ac839fe7105ff4122933112068d910fb4609a10172","observation_id":"97a3dfbb-e648-41b4-8c9b-f6b0057bca99","resolution":{"observed_at":"2026-08-06T21:19:34.352992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:34.080286Z","title":"Drivedreamer: Towards real-world- drive world models for autonomous driving","venue":null,"work_id":"5d5cabe6-1047-4e93-9753-eba2641b9f0d","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.211308Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:f41d25f091f4b71a4cda62c91786515ee10b25cbddb5826e20563a336ce2eace","observation_id":"f165220a-96a0-4b45-9591-19ba24858a8a","resolution":{"observed_at":"2026-08-06T21:19:34.177795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.915484Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving","venue":null,"work_id":"2d2fe262-a893-456b-9bad-374fec5d901b","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.321359Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:7635026bba6adefbc97cb5140119b393949d64f7375f9d77bf929946093cd94f","observation_id":"dc92a3fb-997c-48d5-ad4b-6b52b408ed8b","resolution":{"observed_at":"2026-08-06T21:19:34.013476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.764359Z","title":"Para-drive: Parallelized architecture for real- time autonomous driving","venue":null,"work_id":"5149f068-dc99-46ff-b1a2-3f51fbd75f7e","year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.420041Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:5f2a9924170ebf7f374222fccecc195fbb9304cacbe7ff8ab31d871b2d779536","observation_id":"34f69d0e-47f3-4ba7-8bea-ae6d279c1fad","resolution":{"observed_at":"2026-08-06T21:19:33.851837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.578444Z","title":"Goalflow: Goal- driven flow matching for multimodal trajectories generation in end-to-end autonomous driving","venue":null,"work_id":"ebe4de76-83ae-4b64-87b9-f63fff8a0c80","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.480525Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:b0606a967b423ddd397a9a32a7e655c92266b15d43b87710b6eb24ddfca37fb2","observation_id":"2d06c762-09a1-422d-ad14-62bd66fe4f96","resolution":{"observed_at":"2026-08-06T21:19:33.665806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.340197Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective su- pervision","venue":null,"work_id":"63e9ee21-bc44-4a5c-907a-95b226140e96","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.565136Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:c8cade0a351920ee71a04ecfefc8296f331df04cc53c95062308207b65c78bef","observation_id":"35669cf3-2d43-4330-841d-1f6e76883f22","resolution":{"observed_at":"2026-08-06T21:19:33.433842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.12826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.474905Z","title":"Uncad: Towards safe end-to-end au- tonomous driving via online map uncertainty","venue":null,"work_id":"23f04f33-1ce8-4042-bd98-0567641ec6ae","year":2025},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.678697Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:83c525e2e185f7662acbc89e296c1f56948411aca0dba04baaf2bafd54270e66","observation_id":"2a31b648-c68f-4137-baae-effdc302a7f1","resolution":{"observed_at":"2026-08-06T21:19:32.558442Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.187360Z","title":"Metric3d: Towards zero-shot metric 3d prediction from a single image","venue":null,"work_id":"83c7865f-a954-4dcf-8df0-9ea7963548ea","year":2023},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.740030Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:2f5601df34cd201c204ecabd681bc5708c1dfb132b9c7220385a54174cfb5b53","observation_id":"d1bdf9e9-930a-47f3-91ea-ebb57e5ca801","resolution":{"observed_at":"2026-08-06T21:19:33.252720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:33.017049Z","title":"Copilot4d: Learning unsupervised world models for autonomous driving via discrete diffusion","venue":null,"work_id":"cbefc48c-2aee-46d6-beac-589c01572c29","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.871893Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:dbc0d664d61fd10d175b9c8bc0a5ee52ca889ceefb22c5bcb613829ba620dfdf","observation_id":"f07abe13-4478-45da-bd94-694769daa85e","resolution":{"observed_at":"2026-08-06T21:19:33.108275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-14T02:05:47.259643Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-06T21:19:31.953866Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:31.953866Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:432528e5d119935ff98be52334c5e35c5e5202ae322ce52f8ce26f2d4e9c75bb","observation_id":"36b5becb-0b33-49fc-acc1-b7f78f4ee496","resolution":{"observed_at":"2026-08-06T21:19:31.953866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.897912Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving","venue":null,"work_id":"f0fabca9-6bac-497f-9037-bb700eeade69","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.111585Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:c3eaa7bdb1e9ae921366c27ca2a202bdf1d4328fd9023a657c17b6e8c3df9522","observation_id":"dd9c9df6-5671-45f1-9011-fa11786930dd","resolution":{"observed_at":"2026-08-06T21:19:32.961648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.754664Z","title":"Genad: Generative end-to-end au- tonomous driving","venue":null,"work_id":"f434f828-d4e8-46df-b403-61f7a4441099","year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.182946Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:668ad5027cba1b3344cefaba399f4e96ee61d304cfe8c7c5e6f195b92dbf8b5c","observation_id":"fa9dc8c2-17e4-4a8c-b72b-526e02cc11bf","resolution":{"observed_at":"2026-08-06T21:19:32.824617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:19:32.259571Z","title":"Preliminary investigation into data scaling laws for imitation learning-based end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:32.259571Z"},"links":{"citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:20b787212df0ca3049d6dd9b5cbec8bb2ccef3161a4e83b2687db016f903a595","observation_id":"7f4e1ff1-c050-4b85-b4dd-8e7de229baa0","resolution":{"observed_at":"2026-08-06T21:19:32.259571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T03:17:51.110230Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 6 inbound Pith citation observations for arXiv:2507.00603."}