{"as_of":"2026-08-09T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b96e9d495887f03d99c77b1456872b3ac2e566db2ec6930fa1e5f91cacb2dfb","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:33:26.603654Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07938/citation-record","integrity":"/paper/2507.07938/integrity","json":"/paper/2507.07938/citation-record.json","paper":"/paper/2507.07938"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:24.489572Z","title":"A survey of autonomous driving: Common practices and emerging technolo- gies,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:24.489572Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:405254763f8f857ec239753f264f3c00ee6e54bc6d284e2bd636f15500da9f71","observation_id":"20539d96-2825-4042-a2bb-3fb6e3d6b48d","resolution":{"observed_at":"2026-08-06T18:33:24.489572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12345","last_updated":"2023-10-18T21:43:37Z","snapshot_observed_at":"2026-07-06T16:35:19.728025Z","submitted_at":"2023-10-18T21:43:37Z","title":"ClusT3: Information Invariant Test-Time Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12345","snapshot_observed_at":"2026-08-06T18:33:24.607371Z","title":"Safety-enhanced autonomous driving using interpretable sensor fusion transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:24.607371Z"},"links":{"cited_paper":"/paper/2310.12345","citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:a37a7e995b6275b2155bfeddd6562e0118f3ef83365be58a806ec4de12bae9e9","observation_id":"8520d665-ff66-47ee-8dbd-4e72f7cb95e7","resolution":{"observed_at":"2026-08-06T18:33:24.607371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:24.769558Z","title":"Planning-oriented autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:24.769558Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:eca209304ecec3821ab017156a23d831b8fb37df651cdced21103766dc26e243","observation_id":"f82fddac-1ecb-415b-9d97-1fe8922bc95b","resolution":{"observed_at":"2026-08-06T18:33:24.769558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.29708","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:27.781087Z","title":"Deep multi-modal object detection and semantic segmentation for au- tonomous driving,","venue":null,"work_id":"f98a6eaa-0f74-4945-956f-7441fb99c647","year":2021},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:24.896397Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:63f00f937d1c0f46b56f64fe83b27e0db36df52f40eaee124622e61ff10c74e7","observation_id":"6c117f6c-590a-4b39-85ec-4e8a6c0c984d","resolution":{"observed_at":"2026-08-06T18:33:27.877104Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.053146Z","title":"Ex- plainable artificial intelligence (XAI),","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.053146Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:ca758604b4e3fbbcd02f65b596804b87611e53e4356765f158a052e16cb0d483","observation_id":"7e43c368-c3a3-400b-b3cd-23fdfd13c3fc","resolution":{"observed_at":"2026-08-06T18:33:25.053146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.10446","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:27.518877Z","title":"Why did the AI make that decision?,","venue":null,"work_id":"b1339a0c-96b1-41f0-9880-e7cebebc99a8","year":2024},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.148590Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:b02680f0e7fef178ae1513a9424f6bf0a7f3091e0d8c05a8aa7cbdf55c72b29d","observation_id":"2a9fe5ed-4484-4588-930e-de14a4d03178","resolution":{"observed_at":"2026-08-06T18:33:27.596507Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.251827Z","title":"Ex- plainable artificial intelligence (XAI),","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.251827Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:eb5a2ffadf317c2881e2cc69669e349f5b04a11aa278cb20e4281e5478aa1604","observation_id":"71590303-b49f-48f7-9bed-69c9d9e00b4d","resolution":{"observed_at":"2026-08-06T18:33:25.251827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.417228Z","title":"Interpretable autonomous driving: A sur- vey of recent advances,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.417228Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:d8abc1154161d9d840e97d0dad96461e681d28450fd4b9a54771f5b8fbedac73","observation_id":"45f9e0cd-7f03-410d-b6de-9df6a1259202","resolution":{"observed_at":"2026-08-06T18:33:25.417228Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.485181Z","title":"Attention- based multimodal framework for au- tonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.485181Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:1e8cca03cf0b838621567e8dce80d377e926e7b118c43479baddd6428a7d3c0a","observation_id":"63ae09ef-8a4d-4c8b-af86-25bb78cb87e8","resolution":{"observed_at":"2026-08-06T18:33:25.485181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.565184Z","title":"DeepDriving: Learning affordance for direct perception in autonomous driving,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.565184Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:8a2a6f45748038f6bb69f9ee0a393d87c19d4f8485e3d94b716aa65442dbeff5","observation_id":"bbbe183c-1677-42ea-b03b-7709cd130195","resolution":{"observed_at":"2026-08-06T18:33:25.565184Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.03938","last_updated":"2017-11-10T17:54:40Z","snapshot_observed_at":"2026-08-03T16:54:06.158198Z","submitted_at":"2017-11-10T17:54:40Z","title":"CARLA: An Open Urban Driving Simulator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.03938","snapshot_observed_at":"2026-08-06T18:33:25.619982Z","title":"CARLA: An open urban driving simulator,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.619982Z"},"links":{"cited_paper":"/paper/1711.03938","citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:1bd62592ab8bfdc9af6119ae15892ef6167c623c9c1c330ff70a7cc6ef1b7f14","observation_id":"fdfd001c-ed76-4d3c-8e29-360eeecfa416","resolution":{"observed_at":"2026-08-06T18:33:25.619982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12602","last_updated":"2022-10-18T09:15:42Z","snapshot_observed_at":"2026-08-09T12:27:33.352994Z","submitted_at":"2022-03-23T17:55:10Z","title":"VideoMAE: Masked Autoencoders are Data-Efficient Learners for Self-Supervised Video Pre-Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12602","snapshot_observed_at":"2026-08-06T18:33:25.677404Z","title":"VideoMAE: Masked autoencoders are data- efficient learners for self-supervised video pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.677404Z"},"links":{"cited_paper":"/paper/2203.12602","citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:f031db21f8af3eef5a2633448624fa708ac4d97018484f8dad691525d11e9981","observation_id":"13d5428e-6ba5-44f3-9677-ad9af44217c8","resolution":{"observed_at":"2026-08-06T18:33:25.677404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.751970Z","title":"BERT: Pre-training of deep bidi- rectional transformers for language under- standing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.751970Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:bd82c429d2df16678b414d09320ea4f9b6e39271c7606a6075fce6232918f120","observation_id":"62b49ade-ec11-4b84-97cf-ba2a095ad09f","resolution":{"observed_at":"2026-08-06T18:33:25.751970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:25.938197Z","title":"nuScenes: A mul- timodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:25.938197Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:f6f4f3e7a76d79d048b28f7fe70243ecf4f58660425a13ab7230009980aa6e44","observation_id":"07b0436b-7af7-4f2d-b463-bff89e3a65bc","resolution":{"observed_at":"2026-08-06T18:33:25.938197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:26.045042Z","title":"BART: Denoising sequence- to-sequence pre-training for natural lan- guage generation, translation, and com- prehension,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.045042Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:8405a2e42c5773afb751fde4a2fd47c288d8af1474657c98492dd4e49062be48","observation_id":"d66212bc-28ca-4069-88b0-d919a9919170","resolution":{"observed_at":"2026-08-06T18:33:26.045042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:26.182936Z","title":"Language-augmented Bird’s-eye View Maps for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.182936Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:2bbf60bce694aff50018ebc2970d15c8f0b5dd408d7cc26885b3a6e1aa60ba58","observation_id":"5f648b4d-208e-469f-bbe9-b5e6a4e582f2","resolution":{"observed_at":"2026-08-06T18:33:26.182936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32567","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:27.022067Z","title":"Vi- sual question answering and natural lan- guage explanations for autonomous driv- ing,","venue":null,"work_id":"e5bec989-d283-420c-b097-2038f6fceebe","year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.293828Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:a955670ea84edaae623ab4bc0b63f7b15ceb482fbc5cd004a7af931770049acc","observation_id":"059c3613-b99e-4c49-a31e-bcee2249e905","resolution":{"observed_at":"2026-08-06T18:33:27.076617Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12345","last_updated":"2023-08-25T22:51:00Z","snapshot_observed_at":"2026-08-02T22:56:44.331922Z","submitted_at":"2023-08-25T22:51:00Z","title":"Antagonising explanation and revealing bias directly through sequencing and multimodal inference","version":1},"cited_work":{"arxiv_id":"2309.12345","doi":"10.48550/arxiv.2309.12345","metadata_source":"pith","pith_arxiv_id":"2309.12345","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Antagonising explanation and revealing bias directly through sequencing and multimodal inference","venue":"cs.HC","work_id":"38c5f74b-738d-4047-b7c1-fc831cffe188","year":2023},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.341130Z"},"links":{"cited_paper":"/paper/2309.12345","citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:57496cbb3716f667ba19f4db3c498c5b6353331c9f5522f5b66009f0167e913d","observation_id":"0ad41744-5391-44a0-8385-d63e9f736a87","resolution":{"observed_at":"2026-08-06T18:33:26.829568Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:28.532389Z","title":null,"venue":null,"work_id":"42840cd0-1a49-414f-897c-4f1d65250801","year":2009},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.410084Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:d5a1718748099a0fd5aa8d1edf3934ee185ee92eaa9942fb2cf5cb0c242c6a42","observation_id":"b7c750e8-da9a-4a73-90ee-405e352b7312","resolution":{"observed_at":"2026-08-06T18:33:28.597555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:28.360078Z","title":"ROUGE: A package for automatic evaluation of summaries,","venue":null,"work_id":"2814d89f-15c0-4283-8ffe-9441947ec90e","year":2004},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.474538Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:ab231bd54c385eba55e1cca5c86120acacb72c18d60bc8b0939329c6cf42bbbe","observation_id":"6f7ac32a-f619-4442-8762-8e0c5f5a6ff2","resolution":{"observed_at":"2026-08-06T18:33:28.484960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:33:28.124206Z","title":"METEOR: An automatic metric for MT evaluation with im- proved correlation with human judgments,","venue":null,"work_id":"81fb5827-e465-4c80-a711-fd5b91a4b0a2","year":2005},"citing_paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:26.603654Z"},"links":{"citing_paper":"/paper/2507.07938"},"observation_digest":"sha256:8feeae18d54df022e2defca75282a3836bfa7270d0f5dfd50bbf180252a6a011","observation_id":"1a763c5f-6605-4540-8378-1459416a7ed9","resolution":{"observed_at":"2026-08-06T18:33:28.231684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07938","last_updated":"2025-07-10T17:21:35Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-09T12:28:16.106059Z","submitted_at":"2025-07-10T17:21:35Z","title":"Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":2,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2507.07938."}