{"as_of":"2026-08-10T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80c832143ccacd414d7909480311670f3a88e2501b18ea1eb49691cf8f1d58d1","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:17:59.256014Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15564/citation-record","integrity":"/paper/2505.15564/integrity","json":"/paper/2505.15564/citation-record.json","paper":"/paper/2505.15564"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:56.835309Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:56.835309Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:1bfd1f1290023882be3fecfa12fdad2b5f7f20b802c3fbdd541b66d26f9e3cff","observation_id":"7e64a61a-71e6-4e4c-be3f-662eaad4cd16","resolution":{"observed_at":"2026-08-07T15:17:56.835309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:56.901743Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:56.901743Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:0eb9c18172a450f6dcf55b54c061d90fce5a35667253cbbff40e598a9f55f454","observation_id":"9fcf04d0-5c10-4474-ad28-1cc727abe1e1","resolution":{"observed_at":"2026-08-07T15:17:56.901743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.011789Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.011789Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:c70225b71a2d9de2c9a75017861e73cfb6f4f317af427b83251ef9f97c077d84","observation_id":"81a3509f-7c9f-4fdd-aaf2-f1548c93f254","resolution":{"observed_at":"2026-08-07T15:17:57.011789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.428430Z","title":"Unireplknet: A universal perception large-kernel convnet for audio video point cloud time-series and image recognition","venue":null,"work_id":"c0ed4c53-4843-4fcc-9b4b-bc1bc3e69e76","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.103782Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:fe3dfa5972cec70f8fbefd07e4f9ef947c077fd15e13157d937838a726a86641","observation_id":"4d7fa30c-2bd9-4463-bbe5-4840fa556a73","resolution":{"observed_at":"2026-08-07T15:18:00.548670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:17:57.217357Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.217357Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:c044ff4efa61d199af62e78a2c994578be58f926dc7682cef549e7089180e521","observation_id":"ab96dcd8-ffb9-4d12-b42c-18ca802dfe8b","resolution":{"observed_at":"2026-08-07T15:17:57.217357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19838","last_updated":"2024-05-09T03:27:44Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T21:18:33Z","title":"Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19838","snapshot_observed_at":"2026-08-07T15:17:57.316187Z","title":"Multi-frame, lightweight & effi- cient vision-language models for question answering in autonomous driving.arXiv preprint arXiv:2403.19838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.316187Z"},"links":{"cited_paper":"/paper/2403.19838","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:9dd5f90b37c41465867c9d0e3d09f23104e8a729576acfde04b26e83c6e88298","observation_id":"b2f4eb50-3c55-4160-9cd0-11feb99c8957","resolution":{"observed_at":"2026-08-07T15:17:57.316187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.239221Z","title":"World models for autonomous driving: An initial survey.IEEE Transac- tions on Intelligent Vehicles, 2024","venue":null,"work_id":"514ad96e-f6e3-498f-a816-325ab1c0f226","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.433962Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:33f649608d5314bf0728376d65efa6dddbce0f9044080adb06112d2df30f84cb","observation_id":"cc0523e0-2561-4f4f-b7aa-3b56e31c720e","resolution":{"observed_at":"2026-08-07T15:18:00.317010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:18:00.092402Z","title":"Traffic navigation via reinforcement learning with episodic-guided prioritized experience replay.Engineering Applications of Artificial Intelligence, 137:109147, 2024","venue":null,"work_id":"2cd3a674-a485-469d-882f-b733812daf1a","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.551778Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:75717348d28b6058df32828e53467594c17de05cdb1f2c965d856b72ced468d1","observation_id":"b2b65d36-4d46-468f-86a0-ccaf1d90e4bd","resolution":{"observed_at":"2026-08-07T15:18:00.157213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.647411Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.647411Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:af2ffa7b9ce306dff546bec129d2003e462b35c3a09b97cb1952154fe3ef54c7","observation_id":"b04098d7-837d-45e3-a4fc-b6e2d66c5290","resolution":{"observed_at":"2026-08-07T15:17:57.647411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.745932Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.745932Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:90b7e2556e595037c6835a8731bc8ba648beec17bfafa08d357fe69831e1b1d7","observation_id":"adfe776a-2b93-459c-bea3-9178be04ecea","resolution":{"observed_at":"2026-08-07T15:17:57.745932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:57.847632Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.847632Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:4bf256902604c79934ddc4def87ef40ce7d130d432dbdaaa05b223f3e6b7157f","observation_id":"d2070f02-8942-400b-9e08-059f04560599","resolution":{"observed_at":"2026-08-07T15:17:57.847632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01415","last_updated":"2023-12-05T05:26:29Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:57Z","title":"GPT-Driver: Learning to Drive with GPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01415","snapshot_observed_at":"2026-08-07T15:17:57.963862Z","title":"Gpt-driver: Learning to drive with gpt.arXiv preprint arXiv:2310.01415, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:57.963862Z"},"links":{"cited_paper":"/paper/2310.01415","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:edc193ed23e6e30f50434457c6ce09df36f500b85eccc2bf8989d8f5b0e63ff9","observation_id":"0a2f6351-13b5-45ad-b891-946d01fd4e1a","resolution":{"observed_at":"2026-08-07T15:17:57.963862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.079631Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.079631Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:3e7aa9021fc3e6cc69bc0a35efadbf3785feaf02399ff83b39615119d1406e81","observation_id":"ec07915b-3b97-4055-9e13-3edc38e08fb6","resolution":{"observed_at":"2026-08-07T15:17:58.079631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.166227Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.166227Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:3253ae9ebecb85bd8ccb94ba10a9bc9cab00cc5efcd1ce10d82384f614befe0d","observation_id":"e5cecba8-b8b8-4b7f-ab72-1511ade3589c","resolution":{"observed_at":"2026-08-07T15:17:58.166227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.253854Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.253854Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:83718bae3d50fae062ceb97d568b962b6f85150ad8c628024aee955e42ad687f","observation_id":"854273ff-82f1-4696-8c80-7089090e3d75","resolution":{"observed_at":"2026-08-07T15:17:58.253854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03026","last_updated":"2025-04-15T03:45:30Z","snapshot_observed_at":"2026-07-06T16:27:51.438846Z","submitted_at":"2023-10-04T17:59:49Z","title":"LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03026","snapshot_observed_at":"2026-08-07T15:17:58.371824Z","title":"Languagempc: Large language models as decision makers for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.371824Z"},"links":{"cited_paper":"/paper/2310.03026","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:2f0c817571584a365f56f544c440a9b16695697456c2563fbb8a72581ee42bc5","observation_id":"4cf5fb0e-f5f1-4926-b229-8a9391362416","resolution":{"observed_at":"2026-08-07T15:17:58.371824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.471551Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.471551Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:571224fbf8452e2b4534675d0642023167e149ede8295faae8ad7df88424255c","observation_id":"8e0f5c14-2aa7-4af8-94d3-8c6fac8f143c","resolution":{"observed_at":"2026-08-07T15:17:58.471551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:17:58.583992Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.583992Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:86ad8023fbb4271ee85f862196e1ab3a71523a80f7a3bc440867b74cfbdf6794","observation_id":"818514c7-db8a-4eb1-8b44-4a4c8fece003","resolution":{"observed_at":"2026-08-07T15:17:58.583992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.839708Z","title":"Labelimg.https://github.com/tzutalin/labelImg, 2015","venue":null,"work_id":"c97ab440-e8c0-4bf5-9e79-1c1a6a4d426c","year":2015},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.674118Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:f5b557b71a056ddb9d900d5ec5be7a49da36544a8e70a82ea6bef5d7407b0e3b","observation_id":"a3677b2e-4668-492c-89d9-238c65436696","resolution":{"observed_at":"2026-08-07T15:17:59.896190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.773109Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.773109Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:19269b5d45639f5fb8a00571f2b0c9d3a280ee7f906ae43efa7d7d0cbfe62996","observation_id":"a7584999-7d05-4416-959c-c21d1714d41a","resolution":{"observed_at":"2026-08-07T15:17:58.773109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.860998Z","title":"Drivemlm: Aligning multi-modal large language models with behavioral planning states for autonomous driving.arXiv preprint arXiv:2312.09245, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.860998Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:df0e08de8938df3d8d52117f91c0e7e883f15f3fa66ddc76d86638b37a506dd8","observation_id":"321dd4d7-77df-4d14-b9b0-03308254573f","resolution":{"observed_at":"2026-08-07T15:17:58.860998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:58.960626Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:58.960626Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:350b677a74e9ec10a94f1466ed5fe77d5c0287c04b67f2d0a3b46785283e8334","observation_id":"158be957-8fc6-47e6-b41e-b78894c8eee9","resolution":{"observed_at":"2026-08-07T15:17:58.960626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.055207Z","title":"Drivegpt4: Interpretable end-to-end autonomous driving via large language model.IEEE Robotics and Automation Letters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.055207Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:57f1b244aac0f476602f4c4c83bd0f946ac71a132674675054e41c34645e7fa3","observation_id":"3b28f699-4774-45af-84c4-92122cd40474","resolution":{"observed_at":"2026-08-07T15:17:59.055207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07267","last_updated":"2025-05-21T08:38:11Z","snapshot_observed_at":"2026-07-06T19:13:46.489307Z","submitted_at":"2024-09-11T13:43:01Z","title":"MiniDrive: More Efficient Vision-Language Models with Multi-Level 2D Features as Text Tokens for Autonomous Driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07267","snapshot_observed_at":"2026-08-07T15:17:59.143731Z","title":"Minidrive: More efficient vision-language models with multi-level 2d features as text tokens for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.143731Z"},"links":{"cited_paper":"/paper/2409.07267","citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:a86de36018694882d708f8aeab380a2619e5ad972aac1cbe2ec2e2e04025c3c9","observation_id":"5d47526d-1234-42ab-842b-a39c6969ca53","resolution":{"observed_at":"2026-08-07T15:17:59.143731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:17:59.590712Z","title":"Vision language models in autonomous driving: A survey and outlook.IEEE Transactions on Intelligent Vehicles, 2024","venue":null,"work_id":"99465c72-f99c-49a8-ae38-9fef33e5e899","year":2024},"citing_paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:17:59.256014Z"},"links":{"citing_paper":"/paper/2505.15564"},"observation_digest":"sha256:bff12ae6a6c384175c58a71cd083e737b3345f0ed20b70f8969e802fb2d7b0cb","observation_id":"55bd7cbd-df46-461e-9fdd-0238a9df4391","resolution":{"observed_at":"2026-08-07T15:17:59.667823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15564","last_updated":"2025-05-21T14:19:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T02:57:17.482534Z","submitted_at":"2025-05-21T14:19:24Z","title":"TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2505.15564."}