{"as_of":"2026-08-05T11:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b01b72d281666026763f51c3a9cf07ddc925bd8426d061d92b6e8c099f861a2","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T22:34:00.895252Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:19:54.962342Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14044","snapshot_observed_at":"2026-07-11T21:09:01.431209Z","title":"arXiv preprint arXiv:2512.14044 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04179","last_updated":"2026-07-05T08:51:47Z","snapshot_observed_at":"2026-07-31T07:27:12.270838Z","submitted_at":"2026-07-05T08:51:47Z","title":"CritiqueDriveVLM: From Verifier-Guided Reinforcement Learning to Latent Thought Distillation for Autonomous Driving","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-11T21:09:01.431209Z"},"links":{"cited_paper":"/paper/2512.14044","citing_paper":"/paper/2607.04179"},"observation_digest":"sha256:072866b781e24e8fc18edb96b6d41791ae04747ad37271d77e120d575b1932ce","observation_id":"b0ae1149-9339-4a00-a69a-5f07d44c1aa4","resolution":{"observed_at":"2026-07-11T21:09:01.431209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14044","snapshot_observed_at":"2026-08-02T01:19:54.962342Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14727","last_updated":"2026-07-16T08:53:25Z","snapshot_observed_at":"2026-08-02T01:19:53.917579Z","submitted_at":"2026-07-16T08:53:25Z","title":"WorkDrive: Roadwork Chain of Causation for Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T01:19:54.962342Z"},"links":{"cited_paper":"/paper/2512.14044","citing_paper":"/paper/2607.14727"},"observation_digest":"sha256:6fb1a1e3f203688c70b0efcf2ae9002e8900fad5b3a134e4e92989fb8c7ab8c0","observation_id":"7f4670d0-8c52-4ed1-8de4-ab39b50d4d4c","resolution":{"observed_at":"2026-08-02T01:19:54.962342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14044","snapshot_observed_at":"2026-07-30T19:51:03.671252Z","title":"Omnidrive-r1: Reinforcement- driven interleaved multi-modal chain-of-thought for trust- worthy vision-language autonomous driving.arXiv preprint arXiv:2512.14044, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23537","last_updated":"2026-07-26T08:13:46Z","snapshot_observed_at":"2026-08-01T15:34:42.670612Z","submitted_at":"2026-07-26T08:13:46Z","title":"ObsDriveBench: Benchmarking Multimodal Understanding under Adverse Weather with Observability Awareness","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T19:51:03.671252Z"},"links":{"cited_paper":"/paper/2512.14044","citing_paper":"/paper/2607.23537"},"observation_digest":"sha256:36e427132cdf2533b3490ada59de190dadc11cc7ae5a5626f1d8d4fcf327a2f7","observation_id":"77a7e98e-5784-4616-913c-0a6729d7b04b","resolution":{"observed_at":"2026-07-30T19:51:03.671252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2512.14044/citation-record","integrity":"/paper/2512.14044/integrity","json":"/paper/2512.14044/citation-record.json","paper":"/paper/2512.14044"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736","venue":null,"work_id":"fda65d69-c33a-43a8-b2b6-7d817a1c10f5","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:6485fed7c3bd73bdc0810eaa9c45ea5c7e2ece08a1c7290f9f2b2321012ec1e1","observation_id":"a8999727-9998-438f-961f-991172fb01ca","resolution":{"observed_at":"2026-05-17T00:13:44.655689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating object hallucinations in large vision-language models with assembly of global and local attention","venue":null,"work_id":"5a3f5ae9-defa-40d8-a4a4-9bc14e29c0ce","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:a1fb0951f9fdcab2c811029b9edeb3d738ae23cba9461f6de7083b12602b6dcb","observation_id":"3b0257e3-60d7-4e64-b889-cba02aca093f","resolution":{"observed_at":"2026-05-17T00:13:44.659776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:146c07feca2966eac6cb2f79e8897964d7c25060c990686c5aed3c467f3e8238","observation_id":"b5e19163-2e6e-4ba9-b324-2e4522965f61","resolution":{"observed_at":"2026-05-16T22:38:37.809618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialbot: Pre- cise spatial understanding with vision language models","venue":null,"work_id":"aebb27e3-17fa-4b95-80a5-48bc2c9e5639","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:28c3face5cd9fd4d19a7eb0588579e1b17ed84c5afce19df9bc63e4a37bb60ee","observation_id":"25ae90c6-53c6-4ffd-a325-30f00c2f838d","resolution":{"observed_at":"2026-05-17T00:13:44.651036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:047f3203e2147fd8b3df2e4156aa937c1c26482f741e90f1f4f88d931dde164c","observation_id":"fcbcc38e-4071-433d-a3aa-9c59cd0287c4","resolution":{"observed_at":"2026-05-16T22:38:37.820176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:07.858539+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spa- tialrgpt: Grounded spatial reasoning in vision-language mod- els.Advances in Neural Information Processing Systems, 37: 135062–135093","venue":null,"work_id":"e0b22a56-fc6b-4a71-a160-42bdd322f703","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:6d89bea9bea7339c2f990e5e9fa01158bf95d40c0d388d3f212b3cd94ad5ae03","observation_id":"38dd5e2d-78e1-41c2-8ce7-fbcb21262aa5","resolution":{"observed_at":"2026-05-17T00:13:44.641354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15510","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T13:03:26.926404Z","title":"Visual thoughts: A unified perspective of understanding multimodal chain-of-thought.arXiv preprint arXiv:2505.15510","venue":null,"work_id":"d2d29f08-bca4-4cf8-a219-9ab88b399d6b","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:55b77ca94a8efdf7285e22d554d43f2652eeccb64f69adeccc6f5b39d85c9389","observation_id":"f9d7b09a-88d0-486d-9790-2d79807b6402","resolution":{"observed_at":"2026-05-16T22:38:37.864781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Talk2bev: Language-enhanced bird’s-eye view maps for autonomous driving","venue":null,"work_id":"5409f6f1-143c-462d-af6a-18243e25851a","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:e861f75d68fbacb7feff23e67493d3a04e23b0a2b97f2290201ddc4a91a8a917","observation_id":"d9250d5b-7e5a-4ded-8e83-f71d72219f86","resolution":{"observed_at":"2026-05-17T00:13:44.646807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04671","last_updated":"2025-04-08T17:09:59Z","snapshot_observed_at":"2026-08-03T21:26:32.144038Z","submitted_at":"2025-01-08T18:31:16Z","title":"Retrieval-Based Interleaved Visual Chain-of-Thought in Real-World Driving Scenarios","version":2},"cited_work":{"arxiv_id":"2501.04671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04671","snapshot_observed_at":"2026-07-03T21:28:58.962434Z","title":"Retrieval-based interleaved visual chain-of-thought in real-world driving scenarios","venue":null,"work_id":"4ee1f56b-eae4-4155-a05c-4c1d334864e1","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2501.04671","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:faa37752cdaf271be3dfbef9f790069b657ee8a1a3124fb2e44705296f8c40c0","observation_id":"f7b6ac57-9991-47a6-a0a8-920044a279fd","resolution":{"observed_at":"2026-05-16T22:38:37.815554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01904","last_updated":"2025-02-05T09:17:01Z","snapshot_observed_at":"2026-07-06T20:16:18.023949Z","submitted_at":"2025-01-03T17:14:16Z","title":"Virgo: A Preliminary Exploration on Reproducing o1-like MLLM","version":2},"cited_work":{"arxiv_id":"2501.01904","doi":"10.48550/arxiv.2501.01904","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01904","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Virgo: A preliminary exploration on reproducing o1-like mllm","venue":"arXiv (Cornell University)","work_id":"46f1ca0b-4c93-45d2-aeb6-e14eeefec8a9","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2501.01904","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:0513fcb0942fecebf999bd21c9b29441645ee07b473df25649488ff9cd806c25","observation_id":"f622c574-0cca-4142-8a67-3835f0c6b501","resolution":{"observed_at":"2026-05-16T22:38:37.799187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Drive like a human: Rethinking autonomous driving with large language models","venue":null,"work_id":"7122e158-5640-437a-8f0b-94ec8d19a5fb","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:8a1ca2fbf5122d98593f097a49773779211d73efd9e61385b3566ba8d523d56a","observation_id":"564b4a28-4b2b-4793-88ca-9f99dc93fefa","resolution":{"observed_at":"2026-05-17T00:13:44.534764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13112","last_updated":"2025-05-27T14:49:49Z","snapshot_observed_at":"2026-08-03T12:16:27.889586Z","submitted_at":"2024-11-20T08:14:01Z","title":"SURDS: Benchmarking Spatial Understanding and Reasoning in Driving Scenarios with Vision Language Models","version":3},"cited_work":{"arxiv_id":"2411.13112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13112","snapshot_observed_at":"2026-07-05T11:41:02.531094Z","title":"Surds: Benchmarking spatial un- derstanding and reasoning in driving scenarios with vision language models","venue":"cs.CV","work_id":"f4ca6aea-f1e8-4324-8d9b-eb9f9da7bc3e","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2411.13112","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:92472aec4af629c54f7a53b6b4dd0569b3166aa22ca74f14002a912b153bb468","observation_id":"7449410f-6457-4048-a8a8-a6799a105b49","resolution":{"observed_at":"2026-05-16T22:38:37.804166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cogagent: A visual language model for gui agents","venue":null,"work_id":"8cf6f0c4-2209-4275-aa3a-b73cfcd0efb8","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:f616bafa3f2fe5ae843fcaa8a9846f635e86fdcf66b175fc234ec0f223f46a73","observation_id":"5fc2333f-29a0-4742-bad0-d3f68cee926c","resolution":{"observed_at":"2026-05-17T00:13:44.596818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual sketchpad: Sketching as a visual chain of thought for mul- timodal language models.Advances in Neural Information Processing Systems, 37:139348–139379","venue":null,"work_id":"85b16696-60ed-44ac-87a8-7d100ad2677c","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:3a20a8accd0a0d277d5b3626d8299bc2d58f038085cb50317ba87d0237aeab10","observation_id":"a85cfac5-4c9c-4517-8d1b-6ad9964ba702","resolution":{"observed_at":"2026-05-17T00:13:44.527675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10621","last_updated":"2025-03-13T17:59:01Z","snapshot_observed_at":"2026-07-06T20:52:09.743730Z","submitted_at":"2025-03-13T17:59:01Z","title":"DriveLMM-o1: A Step-by-Step Reasoning Dataset and Large Multimodal Model for Driving Scenario Understanding","version":1},"cited_work":{"arxiv_id":"2503.10621","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10621","snapshot_observed_at":"2026-07-05T11:41:02.478415Z","title":"Drivelmm- o1: A step-by-step reasoning dataset and large multimodal model for driving scenario understanding","venue":"cs.CV","work_id":"9202cb0d-c224-47da-8483-b5e054b86064","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2503.10621","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:b5150a4573e5b1b00262c5eb16a3a0b84eaaaaff0df1eea2165794716943e21f","observation_id":"c43a34f0-d07f-492c-adaa-5a1efc4ab763","resolution":{"observed_at":"2026-05-16T22:38:37.834021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4o: The cutting-edge advance- ment in multimodal llm","venue":null,"work_id":"165d5938-e01a-4387-a39b-0a9359b50527","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:b80590454dcda0549558cce8f3c6f186c99b169e52e0059d72101a1bbcefb3f0","observation_id":"0fc9ffd2-80b0-4962-adc2-2f7310766ce1","resolution":{"observed_at":"2026-05-17T00:13:44.636959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16192","last_updated":"2025-05-30T06:35:34Z","snapshot_observed_at":"2026-07-06T21:28:15.523434Z","submitted_at":"2025-05-22T03:50:13Z","title":"VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought","version":2},"cited_work":{"arxiv_id":"2505.16192","doi":"10.48550/arxiv.2505.16192","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16192","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vlm-r 3: Region recognition, reasoning, and refinement for enhanced multimodal chain-of-thought","venue":"ArXiv.org","work_id":"6a03af7b-9707-4490-b621-31f404430027","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2505.16192","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:c51f3208f9ac5fedadb7aa9c1f54daee70d50070dcdd99f6e6ff81f388dbf069","observation_id":"6b6f1835-d10b-4e24-ae05-668478a595b6","resolution":{"observed_at":"2026-05-16T22:38:37.829832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07542","last_updated":"2025-01-13T18:23:57Z","snapshot_observed_at":"2026-08-02T11:23:33.987927Z","submitted_at":"2025-01-13T18:23:57Z","title":"Imagine while Reasoning in Space: Multimodal Visualization-of-Thought","version":1},"cited_work":{"arxiv_id":"2501.07542","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.07542","snapshot_observed_at":"2026-07-10T13:37:06.824298Z","title":"Imagine while Reasoning in Space: Multimodal Visualization-of-Thought","venue":"cs.CL","work_id":"fe549c4a-19fa-421a-9a30-230932ba737e","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2501.07542","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:223b2d1294f3cd46d177bc9c2d33016469e44d6820502628c16531b2ae6e57ef","observation_id":"b4225f2d-f860-4ad9-9a66-e2375c4d7868","resolution":{"observed_at":"2026-05-16T23:09:34.995208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"03e67f9c-49c1-47bf-9af0-535bc51f8336","year":2023},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:1b8faa06a206058dc263da1b444d0c3c48d700fdb580c809f0f103679f1599e6","observation_id":"6ba9468c-03ce-428e-8273-939cc7b96e70","resolution":{"observed_at":"2026-05-17T00:13:44.613542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20797","last_updated":"2024-06-17T17:51:50Z","snapshot_observed_at":"2026-07-06T18:23:15.098065Z","submitted_at":"2024-05-31T13:59:18Z","title":"Ovis: Structural Embedding Alignment for Multimodal Large Language Model","version":2},"cited_work":{"arxiv_id":"2405.20797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20797","snapshot_observed_at":"2026-07-04T19:50:10.268440Z","title":"Ovis: Structural embedding alignment for multimodal large language model","venue":null,"work_id":"6f4025f6-a13c-4549-b0dc-8f2bb5a5a954","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2405.20797","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:7bed802d5f0e2711f54f9b0b70d16165d029af7f1912f79adc9a00a3e31ed5d0","observation_id":"f2ec3220-6993-45e7-afe4-3c0d2f6efae1","resolution":{"observed_at":"2026-05-16T22:38:37.851700Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-task collaborative network for joint referring expression comprehension and segmentation","venue":null,"work_id":"68073aa2-2915-49c1-8ae2-30c2c45fd4f7","year":2020},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:5cb1798e5c14571f77fac157e5fa521e0540a19b7a44fdf4a57b70799f2e05f4","observation_id":"1e36752f-b7ee-425b-abb5-f51d4bf94c52","resolution":{"observed_at":"2026-05-17T00:13:44.545563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional chain-of-thought prompting for large multimodal models","venue":null,"work_id":"5952f36a-196c-461f-b6ee-bc439fc65ce8","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:18746804ceb95aedd45d7b215f6bb95a93206425329d3d98f92bd03b2a041edf","observation_id":"d8c4ef7e-50ba-450a-b859-78162166a43d","resolution":{"observed_at":"2026-05-17T00:13:44.570785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reason2drive: Towards 9 interpretable and chain-based reasoning for autonomous driv- ing","venue":null,"work_id":"617fbfa8-fc0d-41ce-8359-3dde44916637","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:89fdb1cd42659a420c8f7daf8a5dbcb78e4862c09bd7691ba173456050bbef05","observation_id":"6836b733-779b-4a40-b565-ab87d298e1bd","resolution":{"observed_at":"2026-05-17T00:13:44.584144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15337","last_updated":"2024-03-02T02:45:33Z","snapshot_observed_at":"2026-07-06T15:59:34.968253Z","submitted_at":"2023-07-28T06:31:34Z","title":"Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation","version":3},"cited_work":{"arxiv_id":"2307.15337","doi":"10.48550/arxiv.2307.15337","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.15337","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2307.15337 (2023)","venue":"arXiv (Cornell University)","work_id":"97c25306-fd08-4e81-adcf-b8e20b62fe82","year":2023},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2307.15337","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:563db9ce240188e17182ab965377525d56ebf829010117010e9a609d5ec3ff03","observation_id":"e2e20f1b-d2c2-44f1-afe6-ad9fd9f22a31","resolution":{"observed_at":"2026-05-16T22:38:37.843547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14824","last_updated":"2023-07-13T05:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-26T16:32:47Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","version":3},"cited_work":{"arxiv_id":"2306.14824","doi":"10.48550/arxiv.2306.14824","metadata_source":"pith","pith_arxiv_id":"2306.14824","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kosmos-2: Grounding Multimodal Large Language Models to the World","venue":"cs.CL","work_id":"46e7f9e9-24c6-49af-b7d5-96159fa6f443","year":2023},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2306.14824","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:100ddd36345062eb7743dc017a15cc1b8d5346d317254c085ecede2549503a00","observation_id":"27d5bed9-c990-4b7d-bc7a-506ff9028bdf","resolution":{"observed_at":"2026-05-16T22:38:37.847515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06195","last_updated":"2024-08-12T14:42:13Z","snapshot_observed_at":"2026-07-31T21:52:59.633187Z","submitted_at":"2024-08-12T14:42:13Z","title":"Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers","version":1},"cited_work":{"arxiv_id":"2408.06195","doi":"10.48550/arxiv.2408.06195","metadata_source":"pith","pith_arxiv_id":"2408.06195","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L., Yang, F., and Yang, M","venue":"cs.CL","work_id":"6cb85815-b0ca-48b2-8106-652ca78e0351","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2408.06195","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:fcf2d0c831cbffad1ded20c2e98f793de778939d1d4f917a580189044d5b3054","observation_id":"7ed99d0c-44d5-4e0c-acab-272436ffcb01","resolution":{"observed_at":"2026-05-16T22:38:37.782622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15298","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:36:59.798429Z","title":"Agentthink: A unified framework for tool-augmented chain-of-thought reasoning in vision-language models for autonomous driving","venue":null,"work_id":"cda6604b-34d8-4ab0-92aa-af608d3f6f6d","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:3fa0f1d56906e0dbe978ad5fbe5b90701a21db37d698820ce41a432037bf8fde","observation_id":"1f895ce6-d123-4730-af20-68e3a7d0c3f4","resolution":{"observed_at":"2026-05-16T22:38:37.838915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nuscenes-qa: A multi-modal visual question answering benchmark for autonomous driving scenario","venue":null,"work_id":"a1feea4f-f258-45ec-a3cf-9c07b951c00d","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:ef5afbb454ad292960ff058d48e02e39eab7c97ef59c36d0adb046c4187d1eff","observation_id":"b1496d82-5aa3-4121-bd5b-91d42061e7a1","resolution":{"observed_at":"2026-05-17T00:13:44.616933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:06:20.313807Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"ee6b8956-3ac5-4cbe-9ab5-9c2078e5a407","year":2021},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:77680970c2249f636d5d37b9c86862fc40a3dc6a02ccc2f78df93333085f7159","observation_id":"796c6162-006a-427b-8054-22d5d255bd9e","resolution":{"observed_at":"2026-05-17T00:13:44.610463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A re- duction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":"b1a5b89d-6ea2-471b-8c8e-5a9eaba31eda","year":2011},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:0f1cbc0038d1f81078ea4fd917d2aad9ae3a7a22e9eb9378ae81b1cbba74d1a9","observation_id":"0ac72360-876e-43b6-b64a-9355f6083418","resolution":{"observed_at":"2026-05-17T00:13:44.538085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual cot: Advancing multi-modal language models with a comprehen- sive dataset and benchmark for chain-of-thought reasoning","venue":null,"work_id":"4b8b5afb-3742-43f4-b3c7-9076b59bac76","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:bf4b3ef6eed90d15d837fcacca745baa0f4fd519510e0fdfe32171b50afeb141","observation_id":"576284b4-18ff-4459-8c11-2ee8401f9887","resolution":{"observed_at":"2026-05-17T00:13:44.593907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:49f95a3c2b842246c26d62fd7d10307470c7f5fb6427ba52567cc11b5cbe894e","observation_id":"420aeb95-a930-453a-9458-c2d39ba4d45b","resolution":{"observed_at":"2026-05-16T22:38:37.787587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":"2504.07615","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-07-11T03:17:51.904109Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","venue":"cs.CV","work_id":"d36889cb-edb6-448f-9a50-36df8b1623e5","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:ae5fec7c683c4139afd759970b81574c656400cc64c363c89206eeda679fe3fd","observation_id":"f3e7f2e0-f35c-443c-b62a-4bfc073645f3","resolution":{"observed_at":"2026-05-16T22:38:37.859935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14150","last_updated":"2025-01-16T10:57:44Z","snapshot_observed_at":"2026-07-06T17:06:45.522731Z","submitted_at":"2023-12-21T18:59:12Z","title":"DriveLM: Driving with Graph Visual Question Answering","version":3},"cited_work":{"arxiv_id":"2312.14150","doi":"10.48550/arxiv.2312.14150","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Drivelm: Driving with graph visual question answering.arXiv preprint arXiv:2312.14150","venue":"arXiv (Cornell University)","work_id":"e96d9f6a-db3a-442d-9a76-d703faaf10fa","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2312.14150","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:2b39e241bbe8d04a9ba9cb819e41a1676629c5c6b4e8d652ed7d969e1f58e1e7","observation_id":"130f7f11-fe50-4878-a24d-315f3df4f5b1","resolution":{"observed_at":"2026-05-16T22:38:37.855821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:e0cc3e677daaadb15ffcc2d6bb916ebc36ffae98d674ea7a5a8b43444ca27df0","observation_id":"4fba5927-37cc-447c-b704-b4f8d23d638e","resolution":{"observed_at":"2026-05-16T22:38:37.760388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08862","last_updated":"2025-02-10T02:00:10Z","snapshot_observed_at":"2026-08-05T06:17:39.997811Z","submitted_at":"2024-08-16T17:44:02Z","title":"Visual Agents as Fast and Slow Thinkers","version":4},"cited_work":{"arxiv_id":"2408.08862","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.08862","snapshot_observed_at":"2026-07-04T19:20:07.274337Z","title":"Visual agents as fast and slow thinkers","venue":null,"work_id":"a240eb55-7ede-4c11-882e-1b2fd1508b4e","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2408.08862","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:a4606877280008e3e285f0f2a48932ec836ba24d88e576d14deac7eef0673814","observation_id":"db83a0d1-2549-4ae9-9fd5-74de9ad7cb6b","resolution":{"observed_at":"2026-05-16T22:38:37.777037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13383","last_updated":"2025-02-19T02:46:52Z","snapshot_observed_at":"2026-07-06T20:38:57.586136Z","submitted_at":"2025-02-19T02:46:52Z","title":"MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification","version":1},"cited_work":{"arxiv_id":"2502.13383","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.13383","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.13383 , year=","venue":null,"work_id":"3f5656c8-faf4-4035-b0b6-799427c459cc","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2502.13383","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:cf2d20a11f69e2e7ca0117e0f9bdc00da82dc6ee9cf968b915daa9cfb9dc45f9","observation_id":"0f425a24-b209-4cc5-9266-1079a6b21814","resolution":{"observed_at":"2026-05-16T22:38:37.764312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":"2403.05530","doi":"10.48550/arxiv.2403.05530","metadata_source":"pith","pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":"cs.CL","work_id":"80e3e977-f1bb-4c83-8d0c-1ab0a0c5c3f1","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:ca36ec7f12e372ef53f1614c0e53e9c108e7c8b981e9d5bc3799ef2d8c04ad45","observation_id":"1bc3df45-86b4-4ddd-9b40-1aec6c4e8f53","resolution":{"observed_at":"2026-05-16T22:38:37.772489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:14.426583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llamav-o1: Rethinking step-by-step visual reasoning in llms","venue":null,"work_id":"d17e78c9-07c3-44dc-966b-a2f8b73626b2","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:03a5067bdc02d5fdccf909781e153aa223108c1f194d0024af4afa0e48ae6546","observation_id":"32e78463-99d1-445e-80d2-2ed4ff4e647b","resolution":{"observed_at":"2026-05-17T00:13:44.607170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llamav-o1: Rethinking step-by-step visual reasoning in llms","venue":null,"work_id":"c4461d76-b2ef-4ce3-9ebe-b5332a27f419","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:85186bf27b503118c06bc7837d7fc76ce67692890fc4a59792e6d8a4b6a439ae","observation_id":"446efc04-e94b-44c4-b7e2-3b8c8ae20c1d","resolution":{"observed_at":"2026-05-17T00:13:44.552301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Om- nidrive: A holistic vision-language dataset for autonomous driving with counterfactual reasoning","venue":null,"work_id":"90da57a0-e949-4af7-b497-60b25f1c233b","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:80b7bcab96d456c915e38b5ff2a47b7d1c6b13dad5c0d14b2c355df6da8647b7","observation_id":"e2100763-cd79-493e-9e2e-8af1e1eed853","resolution":{"observed_at":"2026-05-17T00:13:44.604048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:8491f4737042e16b2a96a010812b81e36458ff7b869c0802a6c00550ad20a2ca","observation_id":"7e6c7e1c-b8ef-4da5-bbe4-0e89317a201e","resolution":{"observed_at":"2026-05-16T22:38:37.869206Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of- thought prompting elicits reasoning in large language models","venue":null,"work_id":"a0e19de6-db78-4188-ae25-adea0cfc8d0a","year":2022},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:6717e325b87d64e8368ec99f89a1d5bd668bc986f334acf49f833334cad70caa","observation_id":"4ec048b3-0182-41a3-bd39-1310f8f6c5ea","resolution":{"observed_at":"2026-05-17T00:13:44.560448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V?: Guided visual search as a core mechanism in multimodal llms","venue":null,"work_id":"2ff2f424-7ec6-481d-bde4-59d3541d46b7","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:a0f56a2324a2554368e6acc9267ccc4d4d1b51d273ca56c3c9b22e6664de1268","observation_id":"3a9ee09b-52ed-4712-95f2-88e04e92af92","resolution":{"observed_at":"2026-05-17T00:13:44.587293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llava-cot: Let vision language models reason step-by-step","venue":null,"work_id":"af60f1e6-beec-4034-b2be-a660f8813f0a","year":2087},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:a7ef1e4a9c33f6b5ec049f2ee5afc71f5e5e2b3a3ee02d3084323ff2d6e27839","observation_id":"5bdcf2d9-0f88-491e-a97b-7ec865a5f00b","resolution":{"observed_at":"2026-05-17T00:13:44.541770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llava-cot: Let vision language models reason step-by-step","venue":null,"work_id":"9ac9c95b-2688-4d0e-b06e-59f681fd030f","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:9b491e92a7f1efa67f846c9afcb99086e6bd3ea3f313e435dbb9371e0fa7a340","observation_id":"b2ba822c-5688-4be4-a143-01c8472bc63d","resolution":{"observed_at":"2026-05-17T00:13:44.581112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Drivegpt4: Interpretable end-to-end autonomous driving via large language model.IEEE Robotics and Automation Letters","venue":null,"work_id":"42405729-7f2d-4991-9e36-a5894b9e0e3d","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:ce0f72be589cf49fd27b9039d9a84be3188d7b83baf9040e684af7862c7ba2f5","observation_id":"81d9e5a5-a3e2-4769-812b-6a52ed018297","resolution":{"observed_at":"2026-05-17T00:13:44.601007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-02T02:03:01.950155Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":"2412.18319","doi":"10.48550/arxiv.2412.18319","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search","venue":"arXiv (Cornell University)","work_id":"75422e11-539a-4a97-b9e7-b01a293d3876","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:dad32cba6f538e2595c27148b15f942984a67c64aca4cd632a69ba6aa0f20c23","observation_id":"06be3bcc-8d74-4ced-b42d-4ba96826ed5f","resolution":{"observed_at":"2026-05-16T22:38:37.768730Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What makes good examples for visual in-context learning?Advances in Neural Information Processing Systems, 36:17773–17794","venue":null,"work_id":"4424b32e-96d1-4fe2-bb62-d82e89cb5bb3","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:45b59e054f0bf2fc35502e6e3c411a6007d0a4045bb132e150a1e8b6d707f9ab","observation_id":"7e8fe309-d0af-4a50-87a4-d32b5717e7ad","resolution":{"observed_at":"2026-05-17T00:13:44.524038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt highlighter: Interactive control for multi- modal llms","venue":null,"work_id":"aa9cd5ae-fd67-48d6-8743-204619775875","year":2024},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:9a1558ce4e2e3f12a95e43e35e037f4d95491c2f9c7d244f6a0d9556951d346b","observation_id":"13849400-eff2-4142-ae61-9293662ee7f7","resolution":{"observed_at":"2026-05-17T00:13:44.590402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ddcot: Duty-distinct chain-of-thought prompting for multimodal reasoning in language models.Advances in Neu- ral Information Processing Systems, 36:5168–5191","venue":null,"work_id":"c45c8f8a-9178-4c56-ae91-e069f697d38e","year":2023},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:3ae616b0c3b2094eb9afb7ba3559acfda4b67880a6bfc7315f10becf48a3d76c","observation_id":"7b84bc3a-c88c-40c8-86a7-2406634d6c31","resolution":{"observed_at":"2026-05-17T00:13:44.498122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02419","last_updated":"2025-08-04T13:40:59Z","snapshot_observed_at":"2026-08-05T09:45:05.007337Z","submitted_at":"2025-08-04T13:40:59Z","title":"Modality Bias in LVLMs: Analyzing and Mitigating Object Hallucination via Attention Lens","version":1},"cited_work":{"arxiv_id":"2508.02419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02419","snapshot_observed_at":"2026-07-02T13:16:58.445020Z","title":"Modality bias in lvlms: Analyzing and mitigating object hallucination via attention lens","venue":null,"work_id":"12c98a20-93e0-44e3-870c-c5c768710448","year":2025},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"cited_paper":"/paper/2508.02419","citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:081d85c13b6a7b29532d60100dd19b03ee49dfb580597702cc35336b7fc01eba","observation_id":"f95b8e37-6aec-401d-94c5-ebcea50c7a13","resolution":{"observed_at":"2026-05-16T22:38:37.792767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seqtr: A simple yet universal network for visual grounding","venue":null,"work_id":"cc991513-1e53-4db2-ab50-a1bb43842c0c","year":2022},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:152bb5edce6116e9237f7beb030c7a26726f258ba950d55fbcc73bf8dd519821","observation_id":"395d273a-5215-4e19-ab6f-c238982726c1","resolution":{"observed_at":"2026-05-17T00:13:44.518728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• 9-10:All steps correctly match or closely reflect the reference","venue":null,"work_id":"8696704b-aaa4-4d70-b0a3-873617d047ad","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:847d3e3bb26bbed792d8c2a9b87778362fb408f9e66c2dbc813243cfc2ec5f19","observation_id":"8a88a8c1-d623-400f-897d-384a0de0dc56","resolution":{"observed_at":"2026-05-17T00:13:44.574587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:Captures almost all critical information","venue":null,"work_id":"917803bf-c87f-45f0-acb6-d13fb98bc03d","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:75ad299712a20f0287e6be12874cb93e6e7b7c9cfb1a1f692cc127dbcd69550e","observation_id":"71831751-c947-4cf1-91e0-96c823804e5e","resolution":{"observed_at":"2026-05-17T00:13:44.567273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:Correctly identifies and prioritizes key dangers","venue":null,"work_id":"b20b663d-dc92-49ba-bd59-7dadbe468a18","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:d5e3f43985f46239a238103c656c0e6c04a4b6b44e431ab0d5cbb2082d8b0a58","observation_id":"8a2421e4-0b27-421a-90c0-310092a27082","resolution":{"observed_at":"2026-05-17T00:13:44.556444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• 9-10:Fully compliant with legal and safe driving prac- tices","venue":null,"work_id":"44e8bfa3-7f76-42c2-9221-21e7aff20b04","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:7469ea7a852da0151668c521d8ab3746106b96951f3fa8d1a3b7f71005555e7d","observation_id":"d85d5b7c-caa5-4507-a844-58fb8535f620","resolution":{"observed_at":"2026-05-17T00:13:44.578203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• 9-10:Clearly understands all relevant objects and their relationships","venue":null,"work_id":"fcc6c0e2-fa05-4651-99d5-47ae9919732f","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:14b434b94bcd8d05c4be18e8eff54d59105c708f238b0fe71f0d3361f2f8d344","observation_id":"4026a917-dc60-4afd-8753-23ca76186f42","resolution":{"observed_at":"2026-05-17T00:13:44.623230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:No redundancy, very concise","venue":null,"work_id":"f58d8e95-454c-4da1-a474-33c8a52347a9","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:12ed2e0987342e33ada056b66050ca011731be7f657b2ef2437040ee9e64c65d","observation_id":"d08ac08e-a689-4aca-98bf-16841a61984b","resolution":{"observed_at":"2026-05-17T00:13:44.563912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:No hallucinations, all reasoning is grounded","venue":null,"work_id":"ccf8fe11-b045-40c7-83d4-8aef95fbb3d2","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:3bb5b1c7f9ac75dad6d8be49ddd6381a4326f50d7daf6c1b987843cbe2951d2e","observation_id":"a43057d9-d6c0-4000-aa5c-d0d573fd6f0a","resolution":{"observed_at":"2026-05-17T00:13:44.633307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:Nearly complete semantic coverage","venue":null,"work_id":"a2ff4fd8-5056-4f92-8831-59c0347e4025","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:7ad6739f2ee77c7d22462d8f196c3eb480010048a3eae46868926834d6219e0a","observation_id":"c4accc52-a18c-4455-904b-b14c47b6037b","resolution":{"observed_at":"2026-05-17T00:13:44.626788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:Displays strong commonsense understanding","venue":null,"work_id":"84faa1ee-8eed-454f-b935-befbf335f769","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:379c1db733bf741e2fa6a4432d5210c7c7c66c813bb1cfeb379b482974dcacd1","observation_id":"b2904002-0484-421d-8e39-c5a2de645692","resolution":{"observed_at":"2026-05-17T00:13:44.629954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"•9-10:No critical steps missing","venue":null,"work_id":"1365c9e5-0ad7-40bd-a072-901a72102eff","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:05588afa61096689c4150dd5fdcb3c576ea750bc3e3f958f5d7cb860d91ce430","observation_id":"1aa9d7e0-6bef-429b-9e42-7afedfea4b22","resolution":{"observed_at":"2026-05-17T00:13:44.620021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• 9-10:Highly specific and directly relevant to the driv- ing scenario","venue":null,"work_id":"718c85a6-8e8d-4550-b55b-83d19d62d120","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:8239c12a06ff6657a635e7fbc832d84262321d48981035ab72bd1f903e2c8144","observation_id":"78080660-7de0-445c-97da-39a46522218f","resolution":{"observed_at":"2026-05-17T00:13:44.548923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"• 9-10:No significant details are missing; response is comprehensive and complete","venue":null,"work_id":"eef9ca4a-5a7b-4e91-914b-61a2ef63c3ad","year":null},"citing_paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-16T22:34:00.895252Z"},"links":{"citing_paper":"/paper/2512.14044"},"observation_digest":"sha256:c29d540472cf722f1daef30c5a6b454b38ccba0c08f05ae4c38b62f34e598730","observation_id":"278b306b-a501-4b82-9e54-59bf62e1b649","resolution":{"observed_at":"2026-05-17T00:13:44.531263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.14044","last_updated":"2026-04-30T14:06:23Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-12-16T03:19:28Z","title":"OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":23,"verified_fuzzy":41},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 3 inbound Pith citation observations for arXiv:2512.14044."}