{"as_of":"2026-08-10T07:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5171420fe073a88ad28e7cc2ab5fdd37c5bd3dcf83da5bacab6d7c599a019595","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T20:32:31.567162Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23511/citation-record","integrity":"/paper/2607.23511/integrity","json":"/paper/2607.23511/citation-record.json","paper":"/paper/2607.23511"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:26.691393Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.691393Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:131cc7bc3a8f0f52eb40cfa74c7f194b2b8b8343d9f080a6e268dba3125d317b","observation_id":"77b89f99-4755-415b-957e-62faab1bb989","resolution":{"observed_at":"2026-07-30T20:32:26.691393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-07-30T20:32:26.761467Z","title":"arXiv preprint arXiv:1604.07316 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.761467Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a5848a4cbe9d66abe8bca4ccbcb55526cf97e2d2ce649169bbe4bca908e4b43f","observation_id":"4248919f-3de0-4bc6-8249-1d1a3b87fa22","resolution":{"observed_at":"2026-07-30T20:32:26.761467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-09T09:38:45.203903Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-07-30T20:32:26.902210Z","title":"arXiv preprint arXiv:2106.11810 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:26.902210Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:7a52f47ad1ba87281535d8633b116dd1ab241eb3803b6f5c3f8d64a6c38cf33f","observation_id":"1d38a84c-b33e-45ab-84ac-5e44be7108be","resolution":{"observed_at":"2026-07-30T20:32:26.902210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13243","last_updated":"2026-04-17T23:12:55Z","snapshot_observed_at":"2026-08-04T01:21:26.466156Z","submitted_at":"2024-02-20T18:55:09Z","title":"VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13243","snapshot_observed_at":"2026-07-30T20:32:27.001497Z","title":"arXiv preprint arXiv:2402.13243 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.001497Z"},"links":{"cited_paper":"/paper/2402.13243","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:e45335d306efab9ef043cbc8bf0bb4d80be75ee9de6999bfc8f2e4c6d88b6904","observation_id":"82519ebe-7844-4df3-96f3-de947793235c","resolution":{"observed_at":"2026-07-30T20:32:27.001497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.095146Z","title":"In: The Fourteenth International Conference on Learning Representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.095146Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:8e7835c231c6e16a89b8deac720df8ee58d46f22cf7a76b4fc2366eb36b05abe","observation_id":"f3af78c0-b873-49e5-a8bb-78fa6c40f7ae","resolution":{"observed_at":"2026-07-30T20:32:27.095146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05092","last_updated":"2026-06-26T08:53:36Z","snapshot_observed_at":"2026-08-07T16:34:09.393556Z","submitted_at":"2026-05-06T16:30:48Z","title":"Driver-WM: A Driver-Centric Traffic-Conditioned Latent World Model for In-Cabin Dynamics Rollout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05092","snapshot_observed_at":"2026-07-30T20:32:27.198258Z","title":"arXiv preprint arXiv:2605.05092 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.198258Z"},"links":{"cited_paper":"/paper/2605.05092","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:6a55a59504d9196cd87af16ea18fb3fb9312f6e23504abd674843db85b065558","observation_id":"c2a7149f-98c2-4ca0-b498-407091c3ede9","resolution":{"observed_at":"2026-07-30T20:32:27.198258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.316909Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(11), 12878–12895 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.316909Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:88a206987c98742811b4662d24e9d4923afe1983a794c414c9b20771758bc0c1","observation_id":"813bd482-30e0-41f5-ba28-a24e03257a5d","resolution":{"observed_at":"2026-07-30T20:32:27.316909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.435765Z","title":"In: Proceedings of the Conference on Com- puter Vision and Pattern Recognition, Vancouver, Canada","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.435765Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:de352eafa6f840ec271fa784aef2f0b737131eb6e44bdcd81b7294fa6fceb86a","observation_id":"110e0f2f-8cf7-4445-9a8d-73aca3d4d47d","resolution":{"observed_at":"2026-07-30T20:32:27.435765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.528245Z","title":"In: Ad- vances in Neural Information Processing Systems (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.528245Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:143a83aa14189e36399fdcc20c637c035c04d5d148e17f229012e1a5099cc0b5","observation_id":"db68c301-ec06-4a43-8aa3-47de690ce5da","resolution":{"observed_at":"2026-07-30T20:32:27.528245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-07-30T20:32:27.592066Z","title":"arXiv preprint arXiv:2505.14683 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.592066Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:89609cade414f45c2d21b6c4ab365637c976ccb4043a6c282f566c5a2e9ee4c8","observation_id":"c58c1ef3-b9a4-4fcd-91dd-48e9b4d0de3e","resolution":{"observed_at":"2026-07-30T20:32:27.592066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.656776Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.656776Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:70372c179ab61ccc5373a8c77e6385ffd4a193e3e7e10e65828c1c4379efae52","observation_id":"7cea9e62-9f0f-4778-857a-ca30ab0c29ea","resolution":{"observed_at":"2026-07-30T20:32:27.656776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.721395Z","title":"arXiv preprint arXiv:2512.03422 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.721395Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:d3172a8ac11d930256693e81b8fbecc092cd7d1b590448931d950e06a84f54f9","observation_id":"873bd727-b8a3-44b4-99b3-a62a30279b50","resolution":{"observed_at":"2026-07-30T20:32:27.721395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.789565Z","title":"In- ternational Journal of Computer Vision134(4), 152 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.789565Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a974a1b40a0d3a65eff0072e8ab39ba296bc20c2fc6c8257dffc500fea3ea6bb","observation_id":"bb27471d-4dbc-486a-8025-215c0687c36e","resolution":{"observed_at":"2026-07-30T20:32:27.789565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:27.921992Z","title":"IEEE Transactions on Image Processing6(9), 1305–1315 (1997) MOJITO 17","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:27.921992Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:24f8eeae08621403a56fae392bdcad9a369ab4ace8016f10fd4e28225dfd74ca","observation_id":"135621dd-7799-4897-83f3-387d4d5e4f5c","resolution":{"observed_at":"2026-07-30T20:32:27.921992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.039948Z","title":"IEEE Robotics and Automation Letters11(1), 226–233 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.039948Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a06a580c74934aae227ae00bf41d69ba05479d96ceb681742bdba8987b09be02","observation_id":"6bf228bc-14e4-4259-a528-4e746cf13796","resolution":{"observed_at":"2026-07-30T20:32:28.039948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.177159Z","title":"On the Move to Meaningful Internet Systems","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.177159Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:e56258279c1c5b938a191e71fadcd3ec02dd4337afc96e5142219da2f32567ff","observation_id":"e01284c4-f917-464c-ab8c-93f0da2fd330","resolution":{"observed_at":"2026-07-30T20:32:28.177159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.313633Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.313633Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:25fd9c5c7a408826f448e977ac0472d77ea9f0dadb3b6a97124f4baba48817a9","observation_id":"9a981c3f-0bd7-40a3-a427-2ddf0b38c5d0","resolution":{"observed_at":"2026-07-30T20:32:28.313633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.432222Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.432222Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:95be1f5a657f770aaaf95c48ddd57651e0a7c1f55508f9ca8c393c4a8db0a588","observation_id":"4d841639-b5f2-4342-8ed1-ba89fd132f64","resolution":{"observed_at":"2026-07-30T20:32:28.432222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-07-30T20:32:28.512306Z","title":"arXiv preprint arXiv:2203.17054 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.512306Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:729b72138ea9f303a00b9d2ebe7ed4e23187a56a150700d71be2e7239b82e8cf","observation_id":"10dafbcf-c168-43d9-b0f2-54a9eba7b58e","resolution":{"observed_at":"2026-07-30T20:32:28.512306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07656","last_updated":"2025-07-11T08:15:30Z","snapshot_observed_at":"2026-08-10T01:38:46.185284Z","submitted_at":"2025-03-07T11:41:18Z","title":"DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07656","snapshot_observed_at":"2026-07-30T20:32:28.580271Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.580271Z"},"links":{"cited_paper":"/paper/2503.07656","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c2737551fd315cb5dd114bd63edd8f2cfd5c131f944544f8d179f6bd6f8a7ea5","observation_id":"b6758fdc-6026-4a55-be27-ff8ca64e8484","resolution":{"observed_at":"2026-07-30T20:32:28.580271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19381","last_updated":"2025-06-03T02:28:31Z","snapshot_observed_at":"2026-08-07T14:12:57.110186Z","submitted_at":"2025-05-26T00:49:35Z","title":"DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19381","snapshot_observed_at":"2026-07-30T20:32:28.653831Z","title":"arXiv preprint arXiv:2505.19381 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.653831Z"},"links":{"cited_paper":"/paper/2505.19381","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:020fa52963343c7157b00278c357b1250b5f54855279ee2f620d67ac684dbd11","observation_id":"049bf77d-00fd-414d-978a-5ebe72ada5a0","resolution":{"observed_at":"2026-07-30T20:32:28.653831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.750013Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.750013Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:26940be7afb065c55ceb953d5e5a8a72f5e5dce19b9f66613e5ed64d4b94bedd","observation_id":"23f09026-68de-4c07-8407-0f8241d60418","resolution":{"observed_at":"2026-07-30T20:32:28.750013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:28.841892Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.841892Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:75f21b7496b49281114c047c733751edd17e22ad01a7d244da91499b977362f2","observation_id":"9ad21512-e556-40c8-bc53-1805f3cd33ea","resolution":{"observed_at":"2026-07-30T20:32:28.841892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10719","last_updated":"2026-07-12T18:02:23Z","snapshot_observed_at":"2026-08-03T17:07:38.286115Z","submitted_at":"2025-12-11T14:59:07Z","title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10719","snapshot_observed_at":"2026-07-30T20:32:28.937993Z","title":"arXiv preprint arXiv:2512.107192(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:28.937993Z"},"links":{"cited_paper":"/paper/2512.10719","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:4d865ed36af9970bd49897b701c8252ef7bcf971ab6f8339b4d2771b4dac20c9","observation_id":"873477c8-0a99-4621-91cd-2e3f47345803","resolution":{"observed_at":"2026-07-30T20:32:28.937993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.015395Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.015395Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:36aedea1e031e0753296d3f0bf5a390e7c7a330cb4e83bd7d8bea7577c29eb6b","observation_id":"e0d730a8-13c5-4dfd-826f-15755a1ef781","resolution":{"observed_at":"2026-07-30T20:32:29.015395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08052","last_updated":"2025-09-29T17:21:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T03:14:04Z","title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08052","snapshot_observed_at":"2026-07-30T20:32:29.090631Z","title":"arXiv preprint arXiv:2506.08052 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.090631Z"},"links":{"cited_paper":"/paper/2506.08052","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:6069e15160a00ab35213d01fecb554e5281ab266e979dbc7d422a3091bc00df1","observation_id":"9f947b19-1e77-4522-94f9-482e539447b9","resolution":{"observed_at":"2026-07-30T20:32:29.090631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-07-06T18:28:42.314877Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-07-30T20:32:29.179218Z","title":"arXiv preprint arXiv:2406.06978 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.179218Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:b4931c6bf48400481eaca675a4c879334b516001a0cef0b8432fc8993af18203","observation_id":"e973c24c-9240-476c-b557-2fecdac9b0d2","resolution":{"observed_at":"2026-07-30T20:32:29.179218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06664","last_updated":"2025-06-07T05:06:05Z","snapshot_observed_at":"2026-08-09T02:59:06.476082Z","submitted_at":"2025-06-07T05:06:05Z","title":"Generalized Trajectory Scoring for End-to-end Multimodal Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06664","snapshot_observed_at":"2026-07-30T20:32:29.296690Z","title":"arXiv preprint arXiv:2506.06664 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.296690Z"},"links":{"cited_paper":"/paper/2506.06664","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:0612b3471ea7eea069a1326b181f7ce48520dc92fecbef9c559650d24ceee44f","observation_id":"4dabccde-2494-4bab-9f03-ce8bd79827b1","resolution":{"observed_at":"2026-07-30T20:32:29.296690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.394694Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.394694Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:7fd8341f8f6ada0c91a1041865dd8bdd912b8f8a1d66e09e26544590aac03d68","observation_id":"910d8078-1742-4f2e-acab-34682e005d29","resolution":{"observed_at":"2026-07-30T20:32:29.394694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.456986Z","title":"In: Proceedings of the Computer Vision and Pattern Recog- nition Conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.456986Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c034aa10a3de1e6d710a85dd6748447197e63cc22d9a6e40ca978c4e8c0a2de9","observation_id":"6b9ce650-a433-4733-b85a-870d6fa6f1af","resolution":{"observed_at":"2026-07-30T20:32:29.456986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.524360Z","title":"Advances in Neural Information Processing Systems38, 14123–14151 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.524360Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a221412e08006c21e43407df6d2a4698ff2690e9add0cb31bbb90e9002a0d272","observation_id":"33b6ce54-195b-4161-981b-0208aa7d2e7b","resolution":{"observed_at":"2026-07-30T20:32:29.524360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.623547Z","title":"arXiv preprint arXiv:2511.18729 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.623547Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c4a7ebbbc031b69f0f3d5d8edea6bafd2eae98788e382e4eacb59d84eec251bf","observation_id":"920ffcbc-748b-41e7-8528-f93cfdbcb672","resolution":{"observed_at":"2026-07-30T20:32:29.623547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.720896Z","title":"arXiv preprint arXiv:2512.09864 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.720896Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:8a8c00d544f132cfbf73d8613de31b6aa6d21e45946b5e4c0c6fbb5b57f099b4","observation_id":"1220f78f-192c-4435-a379-e70eb06e3024","resolution":{"observed_at":"2026-07-30T20:32:29.720896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.775309Z","title":"arXiv preprint arXiv:2509.13769 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.775309Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:4ff531e22dbd49b92214ec40d5007f4fa504ef1a7e09037ca69fb53fbc16160c","observation_id":"3751734d-4e78-43fa-8377-b42a704830b5","resolution":{"observed_at":"2026-07-30T20:32:29.775309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.835691Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.835691Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:18cec7caab74987e2266da431f7b3c5ebaae4eb53344ff11256bf9ed184ffa02","observation_id":"aa71d1e8-8dea-4750-81c2-ea1f973b4d9d","resolution":{"observed_at":"2026-07-30T20:32:29.835691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.895772Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.895772Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:3b9ac8fd285f2c2713911f6646c52fc78f9493b57677fe5cd64208101492e74b","observation_id":"9951b8da-c15e-46ac-8fa7-3eccd1e6fdde","resolution":{"observed_at":"2026-07-30T20:32:29.895772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:29.948822Z","title":"arXiv preprint arXiv:2602.13301 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:29.948822Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:13eceefc61eb9e46ac94f3ef4bb0f1443dd000bfc29a5c460c6bfccf57bdf793","observation_id":"83e622fa-a3a4-4634-b544-1e6926fbdddf","resolution":{"observed_at":"2026-07-30T20:32:29.948822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19620","last_updated":"2024-05-31T07:40:55Z","snapshot_observed_at":"2026-08-10T01:38:48.954025Z","submitted_at":"2024-05-30T02:13:56Z","title":"SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19620","snapshot_observed_at":"2026-07-30T20:32:30.026655Z","title":"arXiv preprint arXiv:2405.19620 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.026655Z"},"links":{"cited_paper":"/paper/2405.19620","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:92165564fd4409cb671501c5f19588b05b18c7f7fc6319c9ac2ab43d154e5fde","observation_id":"dbb4d79a-8c83-404f-a82f-011be0e57ddb","resolution":{"observed_at":"2026-07-30T20:32:30.026655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.106967Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.106967Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:caf5ce6c0a55d60fe5a520d04bc28538dd11c8c5278ec635405a284c0ded1224","observation_id":"bb4fcd49-363e-4bcc-8d9e-ae282df67cf0","resolution":{"observed_at":"2026-07-30T20:32:30.106967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.198010Z","title":"ACM Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.198010Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:39f2ba121e6d453725ce7e92b9ab895a22dd26ada14a043fc63eac5bd44ee222","observation_id":"d5f3b6d3-62f8-4fc5-8673-0108730a71ec","resolution":{"observed_at":"2026-07-30T20:32:30.198010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-30T20:32:30.295917Z","title":"arXiv preprint arXiv:2503.20314 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.295917Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:4b31d18da5185c06e2c1be2aa17ba0dc6a079fa26de1c288bbe451997ceb765e","observation_id":"0cc6ac1e-d45e-4ed2-8b4c-ab90d0b5afd5","resolution":{"observed_at":"2026-07-30T20:32:30.295917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.399969Z","title":"In: Proceedings of the computer vision and pattern recognition conference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.399969Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:de229ba70cecf23ab6fbd1af1db72be22790b87c1cef9235a516ece458cf7ebf","observation_id":"8e40d7fb-efc3-4dc1-a4a3-20c1ee370be5","resolution":{"observed_at":"2026-07-30T20:32:30.399969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12170","last_updated":"2025-07-18T12:26:43Z","snapshot_observed_at":"2026-08-07T17:01:48.656587Z","submitted_at":"2025-03-15T15:23:35Z","title":"DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12170","snapshot_observed_at":"2026-07-30T20:32:30.470495Z","title":"arXiv preprint arXiv:2503.12170 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.470495Z"},"links":{"cited_paper":"/paper/2503.12170","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:0234416d0e271f957f545a37c4bb90ca9f097c12ec607f46f1e2d80119530282","observation_id":"aad98c4d-102f-481e-ab1f-e62ed70b3ae9","resolution":{"observed_at":"2026-07-30T20:32:30.470495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.537018Z","title":"Advances in Neural Information Processing Systems38, 140367–140387 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.537018Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:6435ff414662d09a0b622e8a09f1895bc2844f401bff9fe8ba63131c20645267","observation_id":"4e914759-5adf-4dde-b32d-06afd33eb20c","resolution":{"observed_at":"2026-07-30T20:32:30.537018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-30T20:32:30.599240Z","title":"arXiv preprint arXiv:2505.09388 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.599240Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:97a4becda4c3390109c592f6b36206bb1a93b9cad4e65eac98fa5a0766fbf4eb","observation_id":"386adcf9-6bbe-4388-9a28-e99511cafebf","resolution":{"observed_at":"2026-07-30T20:32:30.599240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.687603Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.687603Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:66b90297f2ecb29acebcc159b4a0952f8ba8851013b74bf82c42ebebf958b43c","observation_id":"34eca01f-ef2b-4686-be36-cb85cc2b6fff","resolution":{"observed_at":"2026-07-30T20:32:30.687603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.782293Z","title":"International Journal of Computer Vision132(11), 4823–4849 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.782293Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:8d229d3becbcce17f90ae7334941ec3a530b42540148e1fe5709ca1ad1be502f","observation_id":"8ddba64a-4e8f-40cc-a3c4-e441e22e763b","resolution":{"observed_at":"2026-07-30T20:32:30.782293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.843498Z","title":"In: Proceedings of the 44th international ACM SIGIR conference on research and development in information retrieval","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.843498Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:a67cf7d84a0b7a64c6f08a82a5f17abbe67502d379782b3f5f21cc22ac50d4b4","observation_id":"f32a9953-0d3c-4776-81dc-7a12bf9981d8","resolution":{"observed_at":"2026-07-30T20:32:30.843498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:30.924177Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:30.924177Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:bb4bfdb17a02c60182bc765047076804f5b7852a28ce0060414da7103d77efa2","observation_id":"aa9bad6b-4953-4dfd-8dfb-11b6e6064339","resolution":{"observed_at":"2026-07-30T20:32:30.924177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.029630Z","title":"arXiv preprint arXiv:2506.06659 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.029630Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:deb04bbbd92609f9288d766e935d1a5ad5c23d1a9c1243d6ff1fcdd0f14cf577","observation_id":"fa387103-1832-4de4-9454-9e18dff1401b","resolution":{"observed_at":"2026-07-30T20:32:31.029630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-03T08:33:00.534249Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-07-30T20:32:31.166241Z","title":"arXiv preprint arXiv:2408.03601 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.166241Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:0b9c4b3233e59763289d9e5c76af4efed0b1a3fbbb06ca11e1966e3f853c77bc","observation_id":"deabebd7-cafe-4082-8697-ea7233ae3cab","resolution":{"observed_at":"2026-07-30T20:32:31.166241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.225537Z","title":"ACM Transactions on Intelligent Systems and Technology8(3), 1–19 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.225537Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:8a86175210bccac66a02189c5bf15dcc8343cfcb39f0500945f703c66963185b","observation_id":"119d2e00-b2cf-48b4-af66-787db4c7895a","resolution":{"observed_at":"2026-07-30T20:32:31.225537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.341916Z","title":"In: The Thirteenth International Conference on Learning Rep- resentations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.341916Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:01b16ef144e21fd3d7169bf512ef43687f0e70b926a823c8d1da80555ae8818f","observation_id":"0f7a8899-3ab2-4635-9b89-4e1ce64eb43e","resolution":{"observed_at":"2026-07-30T20:32:31.341916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.428513Z","title":"In: International Conference on Learning Rep- resentations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.428513Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:51f5b2047c75814e2e3d3393d43f2fdd3078d233c283e85f1606ff1a25403ab0","observation_id":"2642771e-1898-4798-bebc-5f20a8da7c4c","resolution":{"observed_at":"2026-07-30T20:32:31.428513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.483781Z","title":"Advances in Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.483781Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:cc05684d2b761c8663498a5381f7a6da6ce9298d0a6288792e2f65f888d2cff4","observation_id":"ea5e806d-27e5-4f17-9203-cce392c218fe","resolution":{"observed_at":"2026-07-30T20:32:31.483781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T20:32:31.567162Z","title":"arXiv preprint arXiv:2512.07745 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-30T20:32:31.567162Z"},"links":{"citing_paper":"/paper/2607.23511"},"observation_digest":"sha256:c1ad5ca54fd8419a25b8cd9a81cf2da1b63d71505a88ebb881f66497a11a0768","observation_id":"b2fea04b-cda3-44db-9ea7-453bb714b9dc","resolution":{"observed_at":"2026-07-30T20:32:31.567162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23511","last_updated":"2026-07-26T07:20:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T00:44:30.793479Z","submitted_at":"2026-07-26T07:20:57Z","title":"MOJITO: Modal Joint Learning for Unified End-to-End Autonomous Driving"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2607.23511."}