{"as_of":"2026-08-10T09:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49b007542a109eac1c239d8ae4fbee59d17a21f7ee3f42598c5a2ddaf7bb5a63","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:27:29.527142Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:41:02.738687Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:26:00.341742Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.04933","last_updated":"2026-04-06T17:59:58Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:59:58Z","title":"PointTPA: Dynamic Network Parameter Adaptation for 3D Scene Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:43:21.705344Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.04933"},"observation_digest":"sha256:1ad341d9564d3407ed63921e1fd70a3bef97c31e11ca1d3e3c2c144b7c0760bd","observation_id":"7ba4c309-276e-4523-90d1-297883d9b421","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.08266","last_updated":"2026-04-09T13:51:55Z","snapshot_observed_at":"2026-08-08T13:20:25.400765Z","submitted_at":"2026-04-09T13:51:55Z","title":"Orion-Lite: Distilling LLM Reasoning into Efficient Vision-Only Driving Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:02:59.008417Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.08266"},"observation_digest":"sha256:ada38a2f6dfb36b9cc580c26a8b5ec46525d35cb7ca28efed5a50f3812242efe","observation_id":"8cb00e1d-1681-4792-851e-42d867a72e85","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.15308","last_updated":"2026-04-16T17:59:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T17:59:44Z","title":"RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T11:40:26.649975Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.15308"},"observation_digest":"sha256:a3805e13db65a52424873feeb08a92c4bc6cad8e620c547f3d30488ae2c221d0","observation_id":"51c2ff29-f615-4989-acf3-288d6436912b","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.18486","last_updated":"2026-05-08T18:23:17Z","snapshot_observed_at":"2026-08-03T04:20:45.612992Z","submitted_at":"2026-04-20T16:37:22Z","title":"Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T05:42:41.112158Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.18486"},"observation_digest":"sha256:73a923a960e82598b42d5096957a7cc6b02db6d822461de7fc1f6f4e5d23fd1c","observation_id":"c9af3925-92a8-4b7f-833b-98978f3edef6","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.18486","last_updated":"2026-05-08T18:23:17Z","snapshot_observed_at":"2026-08-03T04:20:45.612992Z","submitted_at":"2026-04-20T16:37:22Z","title":"Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T00:54:23.508845Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.18486"},"observation_digest":"sha256:e0cd375293d6a383a9039f5cdf34baf47d39962e71bc7794fb0d3996beddd642","observation_id":"e5a188c7-178f-4979-96f9-2b79aac3b7fc","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.19710","last_updated":"2026-04-21T17:34:19Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T17:34:19Z","title":"SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T02:34:29.624029Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.19710"},"observation_digest":"sha256:d1f7c49dbdc573019d1a789c469b7fe570f7f796c031900fcd5aedb0e82b3346","observation_id":"0ec26a4d-135b-46f5-9b0d-9f0d725407cd","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2604.28196","last_updated":"2026-04-30T17:59:58Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:59:58Z","title":"HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-07T05:31:59.676725Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2604.28196"},"observation_digest":"sha256:e824835a4adc42a33e8cc6f11e66055115deb1cb8422cd8979fc61a4cd1be8bb","observation_id":"c42cfb63-1d14-423f-ad2b-9d2138cfbc58","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2605.04470","last_updated":"2026-05-06T03:49:01Z","snapshot_observed_at":"2026-08-07T00:25:29.061580Z","submitted_at":"2026-05-06T03:49:01Z","title":"CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T17:20:55.364175Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2605.04470"},"observation_digest":"sha256:781e3a2aed487f3c91bc458fcc82a299346a105cb21e89820507149d1270ff66","observation_id":"2bb7ed72-044f-4308-86e6-79f06322e74b","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2605.22089","last_updated":"2026-05-21T07:31:49Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T07:31:49Z","title":"LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T07:37:11.292270Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2605.22089"},"observation_digest":"sha256:6050de4d8ca75f62f108ab2242e0f35f0bf5c72e82b6b28e9b48b90ececf0b6c","observation_id":"52c8d0a4-77e8-42d1-b376-952d54b5e150","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2512.13636","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-07-20T02:18:22.862599Z","title":"Minddrive: A vision-language-action model for autonomous driving via online reinforcement learning","venue":null,"work_id":"194e5628-5507-415b-b9dd-adf44a066c35","year":2025},"citing_paper":{"arxiv_id":"2605.31572","last_updated":"2026-05-29T17:40:04Z","snapshot_observed_at":"2026-08-07T10:08:21.298450Z","submitted_at":"2026-05-29T17:40:04Z","title":"nuReasoning: A Reasoning-Centric Dataset and Benchmark for Long-Tail Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T22:35:04.552901Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2605.31572"},"observation_digest":"sha256:35c5efbd35bea15bb578e7a7568875b834d47e35127e211cc89f260f77d11f95","observation_id":"63068931-e425-435d-b725-79e0db418180","resolution":{"observed_at":"2026-07-20T02:18:22.862599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13636","snapshot_observed_at":"2026-08-06T00:41:02.738687Z","title":"arXiv preprint arXiv:2512.13636 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01035","last_updated":"2026-08-07T13:22:07Z","snapshot_observed_at":"2026-08-10T08:11:37.524522Z","submitted_at":"2026-08-02T06:45:16Z","title":"WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-06T00:41:02.738687Z"},"links":{"cited_paper":"/paper/2512.13636","citing_paper":"/paper/2608.01035"},"observation_digest":"sha256:a28bc4aa91956b82ad52372d82767cacf4d463fc79a89902cc4e016621da6bb7","observation_id":"454d4a46-9bdd-4d70-9974-5346f8db67be","resolution":{"observed_at":"2026-08-06T00:41:02.738687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.13636/citation-record","integrity":"/paper/2512.13636/integrity","json":"/paper/2512.13636/citation-record.json","paper":"/paper/2512.13636"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-03T16:27:21.692161Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:21.692161Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:8c703c137d369ba627cdfec41d3026cf7d89d7fb3661d21101a0bca768548b3f","observation_id":"59bfce82-cc05-4185-922c-08a15d401c28","resolution":{"observed_at":"2026-08-03T16:27:21.692161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-03T16:27:21.784322Z","title":"Gemini: A family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 1, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:21.784322Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:69ef4a54ca064c6bf556e8170488080fcd83f62b5d068e35c0ae3ed68b34402f","observation_id":"f132105f-0225-41e5-b30b-98e4a4c3199a","resolution":{"observed_at":"2026-08-03T16:27:21.784322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-03T16:27:21.849156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:21.849156Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:c7d2959ef0a3da269aa6f546c47ba1505cd1cdae4fe7086255d9851cbf2a219f","observation_id":"c0093a97-6789-4502-891b-173d87b0d6e5","resolution":{"observed_at":"2026-08-03T16:27:21.849156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:21.946994Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:21.946994Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:58a8e49001f563ffb975bc9d55a5abac38fc565deae28ccab9bc9e6ba506a8ef","observation_id":"233044d6-5ca6-41cf-b298-0892dc14cf4e","resolution":{"observed_at":"2026-08-03T16:27:21.946994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.014453Z","title":"Rethinking imitation-based planners for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.014453Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:a917df1b6b8c1beb5e0431b856ef098523bb97229a027cb5b322fb026699eaee","observation_id":"528dba99-439d-4248-8cb5-e7d2f3801721","resolution":{"observed_at":"2026-08-03T16:27:22.014453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.092540Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.092540Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:32f3abea95b989b04a725c2151735572fe48c8f9cd2fe032c8e7691b0f8305f8","observation_id":"dcd1a6a9-e91e-47a3-afec-d4ee821e2260","resolution":{"observed_at":"2026-08-03T16:27:22.092540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.217352Z","title":"Causal confusion in imitation learning.Proc","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.217352Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:07898b0678fe70a5c30ca8a52748cd06f7af30d3bef007c2ffe0f09c9db5dda9","observation_id":"7246d9dd-c690-4afe-8be2-ddcebafee858","resolution":{"observed_at":"2026-08-03T16:27:22.217352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.337275Z","title":"Carla: An open urban driving simulator","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.337275Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:4e535940fc61161cbdc7f3610c32745a0492a21ab0fac448b9e2d74476e0049d","observation_id":"911420ba-c21a-48b0-b273-fc456810c363","resolution":{"observed_at":"2026-08-03T16:27:22.337275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.490279Z","title":"Eva-02: A visual representation for neon genesis.Image and Vision Computing, 149:105171,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.490279Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:9c6cecafbb60a7520355c2bf2fba910057976f6fde6a18ea9aed2108aed34fb7","observation_id":"1b8a225a-2cda-447b-8669-38ed6daaae77","resolution":{"observed_at":"2026-08-03T16:27:22.490279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.574716Z","title":"Orion: A holistic end-to- end autonomous driving framework by vision-language in- structed action generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.574716Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:0926912d2cdb6617f09d0d072a5d80f6903e5d2261bc67d26aeaa71f6f5bd338","observation_id":"89c7b583-a37b-4b03-8cc3-9f99cff6a5b5","resolution":{"observed_at":"2026-08-03T16:27:22.574716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.731958Z","title":"Rad: Training an end-to-end driv- ing policy via large-scale 3dgs-based reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.731958Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:5db16022682a267fa00ac2799cf253fbc0d75bb6d053897a4096512f2d61ca50","observation_id":"ff40ba80-aa39-4388-8c45-2ed7b269eb0a","resolution":{"observed_at":"2026-08-03T16:27:22.731958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-03T16:27:22.846189Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.846189Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:37c33ab7fbe8e2fddd2f84daaba07d0739434a093ab72665666326b970b1b527","observation_id":"3732c1dc-d0a0-41f3-9ed4-89cff27e8057","resolution":{"observed_at":"2026-08-03T16:27:22.846189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:22.971854Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:22.971854Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:7be1dbb4af0f48fcecf67b21063d818c927cf392e3fe31b93df751b5c063f6ab","observation_id":"79e99c3d-4733-4b22-a1f1-9365e43277e2","resolution":{"observed_at":"2026-08-03T16:27:22.971854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.079564Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.079564Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:7c0b4c98794c1ca977f531bad9dabc2f69aa4e1a37965dcf2181e689998fa433","observation_id":"c7944644-6730-4fd0-acf8-47da9b28bf1f","resolution":{"observed_at":"2026-08-03T16:27:23.079564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.187751Z","title":"Robotron- drive: All-in-one large multimodal model for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.187751Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:55de92bc69134ffd379bf164745248360f89089ff9094a1ce53add1763a116ba","observation_id":"4e0a4c25-8eca-475a-aaf6-3c8330d23d95","resolution":{"observed_at":"2026-08-03T16:27:23.187751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.343716Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.343716Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:417f03aff137761f4860dac336145f7bef05486794dcc38829688d65eb8b622c","observation_id":"1a281b17-eaff-4756-a9c0-e7c90ea69667","resolution":{"observed_at":"2026-08-03T16:27:23.343716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-03T16:27:23.348474Z","title":"Emma: End-to-end multimodal model for autonomous driving.arXiv preprint arXiv:2410.23262,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.348474Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:d0bb55fa1e8d5a5463dfb538a475f60f87e6cf16ff3dac952e144a163190efe3","observation_id":"660ccc9f-d1d9-4a88-b1b4-5ef213ac661e","resolution":{"observed_at":"2026-08-03T16:27:23.348474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-03T16:27:23.426184Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.426184Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:28f98a0f42955305f6b0924bea33519f5ffa3dfa457470ea958033c5fbe5a902","observation_id":"da3fe36e-dd70-4f7a-8681-45877e354712","resolution":{"observed_at":"2026-08-03T16:27:23.426184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.594016Z","title":"Driveadapter: Breaking the coupling barrier of perception and planning in end-to-end autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.594016Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:4ba41432bcb4fab7c6a994c4dff68afae10bad97fc254c6380ae097eb5c4d69a","observation_id":"35c8683e-999e-4044-8610-40c626781cc4","resolution":{"observed_at":"2026-08-03T16:27:23.594016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.792066Z","title":"Think twice before driv- ing: Towards scalable decoders for end-to-end autonomous 9 driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.792066Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:105f81c2e9ba8114daea723ac7c7dac2b476a1cbd670a3b02f9a527b260da752","observation_id":"ec8a0536-ab4d-46c5-9022-79d38f110720","resolution":{"observed_at":"2026-08-03T16:27:23.792066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13331","last_updated":"2024-03-21T04:01:10Z","snapshot_observed_at":"2026-08-09T01:21:32.219675Z","submitted_at":"2024-03-20T06:22:37Z","title":"AMP: Autoregressive Motion Prediction Revisited with Next Token Prediction for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13331","snapshot_observed_at":"2026-08-03T16:27:23.884686Z","title":"Amp: Autoregressive mo- tion prediction revisited with next token prediction for au- tonomous driving.arXiv preprint arXiv:2403.13331, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.884686Z"},"links":{"cited_paper":"/paper/2403.13331","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:fe231ce5aefe0f18662d9c5057bba4eb8957f6f84cbdf2627d27a188a7cce804","observation_id":"44c77c52-4c20-40ae-9d44-ad9cf1580c78","resolution":{"observed_at":"2026-08-03T16:27:23.884686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:23.959702Z","title":"Bench2drive: Towards multi-ability bench- marking of closed-loop end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:23.959702Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:efad8bf721a1410b587e0225e257299e17f64599b764caff4e38f6ebe5411f45","observation_id":"109d2a34-14ae-4077-b739-93c35d2e6e05","resolution":{"observed_at":"2026-08-03T16:27:23.959702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:24.074791Z","title":"Drivetransformer: Unified transformer for scalable end-to- end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.074791Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:58d0d5d1e5103c8d0459255cdff575a2a6fa81971220316dc3c7f41a1d4e6b5b","observation_id":"1d5b01d1-79b9-4db8-9ddc-d63ad5c37101","resolution":{"observed_at":"2026-08-03T16:27:24.074791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06571","last_updated":"2025-08-15T05:19:30Z","snapshot_observed_at":"2026-08-05T23:41:31.354015Z","submitted_at":"2025-08-07T06:30:05Z","title":"IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06571","snapshot_observed_at":"2026-08-03T16:27:24.257956Z","title":"Irl-vla: Training an vision-language- action policy via reward world model.arXiv preprint arXiv:2508.06571, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.257956Z"},"links":{"cited_paper":"/paper/2508.06571","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:0c7f0728787855bab731aa8bf2385a014e655330d466aae6736c0fcbcc2da6d4","observation_id":"78427e88-2f27-4152-ac07-e3e37463355d","resolution":{"observed_at":"2026-08-03T16:27:24.257956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:24.420607Z","title":"Vad: Vectorized scene representation for efficient autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.420607Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:62dc54ad0b445bd36c00dac074adc4da6f7129f879ce16ff9822580aa6d7fbde","observation_id":"eaa76dc4-ff28-444e-9487-3f0d9f974509","resolution":{"observed_at":"2026-08-03T16:27:24.420607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-08-03T16:27:24.542315Z","title":"Alphadrive: Unleashing the power of vlms in autonomous driving via reinforcement learning and reason- ing.arXiv preprint arXiv:2503.07608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.542315Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:6b1e4daacf9bed5b0e22d2ab3789284b3db8feb5f07aa0a0d1d73b2f69a5cbea","observation_id":"c877e727-9a48-4685-8fab-39886526318b","resolution":{"observed_at":"2026-08-03T16:27:24.542315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-03T16:27:24.778112Z","title":"Openvla: An open-source vision-language-action model.arXiv preprint arXiv:2406.09246, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.778112Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:717d87ae604d0039a131cbd3a38e1ec691c34ae5735d7a34efff7e9ab0904479","observation_id":"ea4f4da0-3f6c-454a-ac4d-33149012bbf8","resolution":{"observed_at":"2026-08-03T16:27:24.778112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-03T16:27:24.896277Z","title":"Auto-encoding variational bayes.arXiv preprint arXiv:1312.6114, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:24.896277Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:047ceae78f586ef68a0a095e3431a0faf9dbdfb7e298d0f8fd588e33067209e6","observation_id":"e5920fcb-a8fa-4f19-b9c1-e8903181c67d","resolution":{"observed_at":"2026-08-03T16:27:24.896277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.029028Z","title":"End-to-end driving with online trajectory evaluation via bev world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.029028Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:b73a3305a2170d9ccd3cdab79652f7c71166410e08eb80182be5e5028bb7d83a","observation_id":"ab29641d-4ba4-40b4-88f6-e3b3558d36eb","resolution":{"observed_at":"2026-08-03T16:27:25.029028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-08-03T16:27:25.151590Z","title":"Recogdrive: A reinforced cognitive frame- work for end-to-end autonomous driving.arXiv preprint arXiv:2506.08052, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.151590Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:3dfb9458dc1868483c7200dbdc861e6f791de1b938dda27b77c282f112aa8010","observation_id":"e29868ec-be55-4953-abfe-6ccb26e18832","resolution":{"observed_at":"2026-08-03T16:27:25.151590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.250058Z","title":"A comprehensive review of multi-agent reinforcement learning in video games.IEEE Transactions on Games, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.250058Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:13c513eb0c4ba3e5c965b9cb124312040e928c4741fb2a7dac5123f6042c1fa4","observation_id":"781b74f2-63b9-4678-b0ba-92418feb06ca","resolution":{"observed_at":"2026-08-03T16:27:25.250058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.357075Z","title":"Diffusiondrive: Truncated diffusion model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.357075Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:6e4880484e8e649b9af0b789f24d740823446db43b65c2a50c6137e6a4c215aa","observation_id":"17ff3771-c994-4b51-bea8-64f7b865a4b5","resolution":{"observed_at":"2026-08-03T16:27:25.357075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09800","last_updated":"2025-06-11T14:42:11Z","snapshot_observed_at":"2026-08-09T08:11:06.729426Z","submitted_at":"2025-06-11T14:42:11Z","title":"Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09800","snapshot_observed_at":"2026-08-03T16:27:25.437416Z","title":"Reinforced refinement with self-aware ex- pansion for end-to-end autonomous driving.arXiv preprint arXiv:2506.09800, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.437416Z"},"links":{"cited_paper":"/paper/2506.09800","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:9330eb02c1b9f039ba03e1033077e0ef36ca04d6942918a5a703618d3f33e7ee","observation_id":"c77a2e83-77b1-4e67-beb8-d14eccbe9706","resolution":{"observed_at":"2026-08-03T16:27:25.437416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.540157Z","title":"Laformer: Trajectory prediction for autonomous driving with lane-aware scene constraints","venue":null,"work_id":null,"year":2039},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.540157Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:cec9b244567895a0ca86559e0a0bf898739cf8e26b37afdb77a4480d6fcb95f6","observation_id":"81a56fcd-77c1-4023-a6fe-81660e05bbfb","resolution":{"observed_at":"2026-08-03T16:27:25.540157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.653897Z","title":"Pillarnest: Embracing backbone scaling and pretraining for pillar-based 3d object detection.IEEE Trans- actions on Intelligent Vehicles, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.653897Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:8e42425c78240d616665de2ccd441ae21842e9ecd4896845af042e463c91666e","observation_id":"3982e14a-9665-4af2-9778-68abafc2f712","resolution":{"observed_at":"2026-08-03T16:27:25.653897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.868951Z","title":"Training language models to follow instructions with human feedback.Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.868951Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:89473607cc49eca4fc74b70abdd62f719cd54e2c22845cebc6aee75f03f77e39","observation_id":"202755f2-330d-43db-9534-4e2ebaf4b033","resolution":{"observed_at":"2026-08-03T16:27:25.868951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:25.978742Z","title":"Agile autonomous driving using end-to-end deep imitation learning.Robotics: Science and Systems, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:25.978742Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:1e5083d9e29a5d3979f95f7dda5a86b1393db01a96af2b60a0d139605fe1ecd3","observation_id":"3f9e0a95-d45d-4314-81f4-da19f837e404","resolution":{"observed_at":"2026-08-03T16:27:25.978742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:26.102754Z","title":"Markov decision processes.Handbooks in operations research and management science, 2:331–434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.102754Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:e3dd6cead31e45d7ab3786200f36edd244c66a34fc65e72d3cba84b80a5eb030","observation_id":"7c7b7d30-c4f6-4800-ba8c-7489a4287210","resolution":{"observed_at":"2026-08-03T16:27:26.102754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:26.219966Z","title":"Direct preference optimization: Your language model is secretly a reward model.Proc","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.219966Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:6e4ff4035641d93b0023801ebf51c5c47fda326d2a03242174c515b6181210f3","observation_id":"26750259-00d6-41b6-8b24-d0a96b1b3815","resolution":{"observed_at":"2026-08-03T16:27:26.219966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:26.333307Z","title":"Simlingo: Vision-only closed-loop autonomous driving with language-action alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.333307Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:1f4a688dcf95e111490fe10aba6f00d9b5253d6fbb965caa2ff4344e5d36c6e1","observation_id":"1e80b5f8-cbdb-46cc-a8cc-8fc539ff2a32","resolution":{"observed_at":"2026-08-03T16:27:26.333307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:26.468955Z","title":"A re- duction of imitation learning and structured prediction to no- regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.468955Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:eb7766150fc15a3e1327388ce345d030532dd6f3ee5e9dda7348702efe29f020","observation_id":"1f34a6ac-366b-400a-a5b9-1f46a4ba5c80","resolution":{"observed_at":"2026-08-03T16:27:26.468955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T16:27:26.681051Z","title":"Proximal policy optimization algo- rithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.681051Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:62a8a956ba04c0da4cbe52c5797975006acb3a6a3894dad2391692b611d0e408","observation_id":"92a85ba4-eb71-489a-ac36-637164c8a99a","resolution":{"observed_at":"2026-08-03T16:27:26.681051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:26.820900Z","title":"Drivedpo: Policy learning via safety dpo for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.820900Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:e55f50bec2e9ac8c9424fe32e8656065cc11a403a19198f1c9e813747c8e7956","observation_id":"ee158214-a4f2-41b9-a0fa-e12172f8fd22","resolution":{"observed_at":"2026-08-03T16:27:26.820900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-03T16:27:26.940908Z","title":"Deepseekmath: Pushing the limits of math- ematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:26.940908Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:4f58e4c9930c0d70110ed5b590a49bc965de233bb6b1ddd9dcfb97460b780565","observation_id":"aece8040-7ef2-40ce-b78a-b5922c1cd18f","resolution":{"observed_at":"2026-08-03T16:27:26.940908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:27.152917Z","title":"Don’t shake the wheel: Momentum- aware planning in end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.152917Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:1c7a7ceacbe10c7a7f35313b2cacadee772ca086457f8480f49a261b9d91414f","observation_id":"c2281929-120f-4181-9463-cd7fc476661d","resolution":{"observed_at":"2026-08-03T16:27:27.152917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-03T16:27:27.268815Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.268815Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:6c545572479c9465724e87cb6b6372a0a0e59352b755e525b344630d44274032","observation_id":"86ff31ad-6fe3-4b8e-894c-c4cded339671","resolution":{"observed_at":"2026-08-03T16:27:27.268815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:27.433261Z","title":"Omnidrive: A holistic vision-language dataset for au- tonomous driving with counterfactual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.433261Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:83d5d48ae6ef44c1bc878043ae3490b4040cef562c1def995b1b70b9ff64f53d","observation_id":"b77a4b3c-d4aa-4afd-8b13-c0cd4ec745d6","resolution":{"observed_at":"2026-08-03T16:27:27.433261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12170","last_updated":"2025-07-18T12:26:43Z","snapshot_observed_at":"2026-08-07T17:01:48.656587Z","submitted_at":"2025-03-15T15:23:35Z","title":"DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12170","snapshot_observed_at":"2026-08-03T16:27:27.595428Z","title":"Diffad: A unified diffusion mod- eling approach for autonomous driving.arXiv preprint arXiv:2503.12170, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.595428Z"},"links":{"cited_paper":"/paper/2503.12170","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:97c75bb3e959b8a62e278a3b9a221fa3e2fc3853a7bd3de63ae52b74771fe6f2","observation_id":"c923041a-47e3-483b-b181-4df2ee73239a","resolution":{"observed_at":"2026-08-03T16:27:27.595428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:27.734557Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models.Proc","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.734557Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:767ab7b06fe465bbeeb1f5227d1e62bf86ed0116f8e2a987097e1da220e1401a","observation_id":"7d6011f1-35c0-4de4-a4ae-aa89808266a1","resolution":{"observed_at":"2026-08-03T16:27:27.734557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:27.899358Z","title":"Openemma: Open-source multimodal model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:27.899358Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:e10369c67fe8b8e599636b28169b41c672829796b6660d0a84b88bb2da5d2c02","observation_id":"af7d0a80-48ef-464f-8530-4bc0241b20dd","resolution":{"observed_at":"2026-08-03T16:27:27.899358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:28.053488Z","title":"Drivegpt4: Interpretable end-to-end autonomous driving via large language model.IEEE Robotics and Automation Let- ters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.053488Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:0030a7ff862e394e378ddfe4397c81eb5e1dc42e647a4707af16340348d51e16","observation_id":"38463ad9-2ac0-41a2-94af-2f6a119a063d","resolution":{"observed_at":"2026-08-03T16:27:28.053488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:28.204682Z","title":"Drivegpt4-v2: Harnessing large language model capabilities for enhanced closed-loop autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.204682Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:99ecc98956cfb097cb90bd896c5558a7d7db5fe49307d23e637ef6a2c92d250f","observation_id":"a5660c2e-0e10-43fd-8abb-9c1112831148","resolution":{"observed_at":"2026-08-03T16:27:28.204682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-03T16:27:28.333680Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.333680Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:89446dd4001a60a4de18e745b6f3eba2df4b974f066774805da534348ec41141","observation_id":"85350009-6181-455a-a46b-0f19804e421b","resolution":{"observed_at":"2026-08-03T16:27:28.333680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16278","last_updated":"2026-05-18T09:58:49Z","snapshot_observed_at":"2026-08-01T11:49:26.764186Z","submitted_at":"2025-05-22T06:23:04Z","title":"DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16278","snapshot_observed_at":"2026-08-03T16:27:28.463717Z","title":"Drivemoe: Mixture-of-experts for vision-language-action model in end-to-end autonomous driving.arXiv preprint arXiv:2505.16278, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.463717Z"},"links":{"cited_paper":"/paper/2505.16278","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:cb3d2bd5750cce8311a6c21f7d187daa16bfaa03b717ab2dfccaad1a3f6014b8","observation_id":"38dd2a8f-4b92-4827-91e2-ce1d83f39183","resolution":{"observed_at":"2026-08-03T16:27:28.463717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:28.607840Z","title":"Raw2drive: Reinforcement learning with aligned world models for end-to-end autonomous driv- ing (in carla v2)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.607840Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:35fa96f5223ba582a588f5bd233d869bdca53c77e818b4f7e4d1d1602fea1159","observation_id":"7b51851b-4b3e-4429-8efe-33992c9a524e","resolution":{"observed_at":"2026-08-03T16:27:28.607840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.01944","last_updated":"2026-04-17T07:58:14Z","snapshot_observed_at":"2026-08-07T14:40:09.002156Z","submitted_at":"2025-09-02T04:32:24Z","title":"AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.01944","snapshot_observed_at":"2026-08-03T16:27:28.756866Z","title":"Autodrive-r 2: Incentivizing reason- ing and self-reflection capacity for vla model in autonomous driving.arXiv preprint arXiv:2509.01944, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.756866Z"},"links":{"cited_paper":"/paper/2509.01944","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:b8b84dea79040e2af4d0d769d36032b9ac339ba52e23b26f300a0a1024229d84","observation_id":"413dbadf-89aa-402f-b86a-5871d580f508","resolution":{"observed_at":"2026-08-03T16:27:28.756866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:28.874400Z","title":"Fully sparse transformer 3-d detector for lidar point cloud.IEEE Transactions on Geoscience and Re- mote Sensing, 61:1–12, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:28.874400Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:becdccd7e9a0a2a7fb2a515faafa82b670ee98f1c5f78639f5186b36f9b02597","observation_id":"58ece019-0a2a-4092-b828-493b0a68eb1f","resolution":{"observed_at":"2026-08-03T16:27:28.874400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06892","last_updated":"2024-04-10T10:34:34Z","snapshot_observed_at":"2026-08-10T01:38:49.059986Z","submitted_at":"2024-04-10T10:34:34Z","title":"SparseAD: Sparse Query-Centric Paradigm for Efficient End-to-End Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06892","snapshot_observed_at":"2026-08-03T16:27:29.000459Z","title":"Sparsead: Sparse query-centric paradigm for efficient end-to-end autonomous driving.arXiv preprint arXiv:2404.06892, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.000459Z"},"links":{"cited_paper":"/paper/2404.06892","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:9a74ec9ffa474e286df0dc3e6979538f21fdb58e49acef8674fd279e4d73ed0e","observation_id":"aecd3367-dbe0-4618-855f-abcd148badc3","resolution":{"observed_at":"2026-08-03T16:27:29.000459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:29.094995Z","title":"Carplanner: Consistent auto-regressive trajectory planning for large-scale reinforcement learning in autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.094995Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:c4dcae1246085c4721371a87e8debf52ea768ec1de8601b0f81c4c44f453bbd1","observation_id":"b9f526c4-df11-4b92-abb3-cd1272bcec6b","resolution":{"observed_at":"2026-08-03T16:27:29.094995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08725","last_updated":"2025-05-13T16:36:51Z","snapshot_observed_at":"2026-08-07T15:45:41.816606Z","submitted_at":"2025-05-13T16:36:51Z","title":"Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08725","snapshot_observed_at":"2026-08-03T16:27:29.207219Z","title":"Extending large vision-language model for diverse interactive tasks in autonomous driving.arXiv preprint arXiv:2505.08725, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.207219Z"},"links":{"cited_paper":"/paper/2505.08725","citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:afa3aa1a6ab657731f993f8f8ffa0d3281dfb610de593bc5039a05e67920d112","observation_id":"1e6634ed-9689-4ee4-83a8-c1f5137017f3","resolution":{"observed_at":"2026-08-03T16:27:29.207219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:29.268196Z","title":"Genad: Generative end-to-end au- tonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.268196Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:43094a1b701f16b814350d8e80261eb09a8d3ca49c3f08b414fcda7868b4ef9d","observation_id":"1647fc84-181c-42f8-b249-eea190a37880","resolution":{"observed_at":"2026-08-03T16:27:29.268196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:29.346933Z","title":"Hermes: A unified self-driving world model for simultaneous 3d scene understanding and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.346933Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:99c99dd54d731396dd05916853c88701d446d93062b6ca77710ddec0717aee3c","observation_id":"717c55ab-41d8-4e99-b8ae-26d4b91415a5","resolution":{"observed_at":"2026-08-03T16:27:29.346933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:29.434445Z","title":"Embodied understanding of driving scenarios","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.434445Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:82019f0dfbd0a0beffaee6ef0578b8dce6f2bf7d1ce2a7c6f463a3a0fc13f100","observation_id":"45b4dfdb-0ee5-43ee-b3e0-6545bac185d8","resolution":{"observed_at":"2026-08-03T16:27:29.434445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:27:29.527142Z","title":"Autovla: A vision- language-action model for end-to-end autonomous driving with adaptive reasoning and reinforcement fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:29.527142Z"},"links":{"citing_paper":"/paper/2512.13636"},"observation_digest":"sha256:27c27427abdd2843d1ac4b39d369ecdad1fbc804f57a84223a4a4e9101bdf11b","observation_id":"209163e1-ee3b-4024-a563-d228999d5bfd","resolution":{"observed_at":"2026-08-03T16:27:29.527142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.13636","last_updated":"2026-07-17T07:01:14Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-04T13:44:30.220787Z","submitted_at":"2025-12-15T18:31:32Z","title":"MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 11 inbound Pith citation observations for arXiv:2512.13636."}