{"as_of":"2026-08-17T05:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:348ec6766ff775a0b96fa86b1f722e26832f3ad29da89f2888d0f7e5e2093318","coverage":[{"denominator":102,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:54:44.708764Z","state":"measured"},{"denominator":106,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":106,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:55:17.400088Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T07:40:29.033821Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-08-11T04:55:17.400088Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.18277","last_updated":"2025-08-04T02:46:55Z","snapshot_observed_at":"2026-08-15T14:30:30.966396Z","submitted_at":"2024-12-24T08:38:35Z","title":"Towards Modality Generalization: A Benchmark and Prospective Analysis","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T04:55:17.400088Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2412.18277"},"observation_digest":"sha256:e8080b030ad0bf47920ab5eb412a21a34a6bae94fe082064723b8c91c53308cd","observation_id":"300ebd99-30bd-466f-bdda-77aae0c069bb","resolution":{"observed_at":"2026-08-11T04:55:17.400088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-08-06T18:05:39.011067Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09174","last_updated":"2025-07-12T07:46:51Z","snapshot_observed_at":"2026-08-16T16:50:18.934908Z","submitted_at":"2025-07-12T07:46:51Z","title":"RAMA: Retrieval-Augmented Multi-Agent Framework for Misinformation Detection in Multimodal Fact-Checking","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:05:39.011067Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2507.09174"},"observation_digest":"sha256:49b2d6f6d1937e9d5f08c1ab9397a1779778396b8ad2a7ec50077a6318a04631","observation_id":"06fa43f2-ad5b-4b03-a15f-9eacfc1c6bfe","resolution":{"observed_at":"2026-08-06T18:05:39.011067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2508.12043","last_updated":"2025-08-16T13:37:11Z","snapshot_observed_at":"2026-08-02T08:29:05.396468Z","submitted_at":"2025-08-16T13:37:11Z","title":"Talk Less, Fly Lighter: Autonomous Semantic Compression for UAV Swarm Communication via LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T07:37:38.901354Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2508.12043"},"observation_digest":"sha256:b8034e61add42af76cc5a766b64e25ad337ffb0d2ad21a1a2f9422fd913af52c","observation_id":"97d17781-0799-4788-b535-eea387d61604","resolution":{"observed_at":"2026-05-25T07:40:29.036810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2508.13998","last_updated":"2026-04-06T03:29:44Z","snapshot_observed_at":"2026-08-15T03:41:08.751572Z","submitted_at":"2025-08-19T16:50:01Z","title":"Embodied-R1: Reinforced Embodied Reasoning for General Robotic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T22:04:34.235731Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2508.13998"},"observation_digest":"sha256:54b1f8704d926a5afa8ecf69dd059ff8cb503a6e1276f0cd11701891ac6b9a77","observation_id":"9bbf6d4c-7617-4d1a-be6b-49776948cd1c","resolution":{"observed_at":"2026-05-18T22:06:51.611452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":"2506.23088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Where, what, why: Towards explainable driver attention prediction","venue":null,"work_id":"b37c667d-b612-4f04-8b37-f6d77477c2df","year":2025},"citing_paper":{"arxiv_id":"2605.07859","last_updated":"2026-05-08T15:20:20Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T15:20:20Z","title":"EyeCue: Driver Cognitive Distraction Detection via Gaze-Empowered Egocentric Video Understanding","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-11T02:27:32.532275Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2605.07859"},"observation_digest":"sha256:d3cd5725e56f7663fa8bec56bbec0eecf49c3c9b788338af89fbdf958752a1bd","observation_id":"3a8f3583-6d87-4098-960b-5a2c044b4e22","resolution":{"observed_at":"2026-05-11T03:30:57.770958Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23088","snapshot_observed_at":"2026-08-01T01:04:36.563566Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25962","last_updated":"2026-07-28T16:45:52Z","snapshot_observed_at":"2026-08-15T05:32:19.410949Z","submitted_at":"2026-07-28T16:45:52Z","title":"LaP-Forensics: Latent-Pixel Consistency Guided Multimodal Reasoning for Deepfake Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T01:04:36.563566Z"},"links":{"cited_paper":"/paper/2506.23088","citing_paper":"/paper/2607.25962"},"observation_digest":"sha256:c53e1bd715f45e36351b823bae27a98debfc3602a67b2b74dc9cd485e755665e","observation_id":"5204747e-15bb-492a-8218-1422d45b83ae","resolution":{"observed_at":"2026-08-01T01:04:36.563566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23088/citation-record","integrity":"/paper/2506.23088/integrity","json":"/paper/2506.23088/citation-record.json","paper":"/paper/2506.23088"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.141881Z","title":"Hammerdrive: A task-aware driving visual attention model","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.141881Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f21b0a2773d90334d36155a50fe322246255f1d2febe60b695557fed8773130e","observation_id":"b049a423-c3f0-4b52-bbd7-9d91945b147c","resolution":{"observed_at":"2026-08-06T21:54:44.141881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.147239Z","title":"Aragan: A driver attention estimation model based on conditional gen- erative adversarial network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.147239Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8765018e51e55c1e24545070a366f4f0685df74805e63ac0edb015c383da9880","observation_id":"f4e9c582-5f65-4f86-b6e4-e0cd65abf2c0","resolution":{"observed_at":"2026-08-06T21:54:44.147239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.152039Z","title":"Medirl: Predicting the visual attention of drivers via maximum entropy deep inverse re- inforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.152039Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0cbef306dffbf9effe45a98bf3edd94162cfa7165de828e946329cf17e5e6f74","observation_id":"42e25dba-f570-4625-911f-273a611b7060","resolution":{"observed_at":"2026-08-06T21:54:44.152039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.157087Z","title":"Drive: Deep reinforced accident anticipation with visual explanation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.157087Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0becb4cb51730591208cb6d4ceb8923b4e27d812de464b6c52755ad253499e31","observation_id":"f97cfec2-f401-4b62-9cc9-f799fe51d3cb","resolution":{"observed_at":"2026-08-06T21:54:44.157087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.161540Z","title":"Re- current mixture density network for spatiotemporal visual at- tention","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.161540Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7302c12521db6c84eb2ad42b496934ca0b7dff8a6d4e2bc369cf0eaa12804cbe","observation_id":"f402f321-e0d9-4d7b-9830-826655d2a11e","resolution":{"observed_at":"2026-08-06T21:54:44.161540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.166053Z","title":"The devil is in the fine- grained details: Evaluating open-vocabulary object detec- tors for fine-grained understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.166053Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:675ea754e37f053623508a15dd70b542d0f6a1ab231eb9e8e946a87b90028d30","observation_id":"b25add0d-ff24-4d50-857c-e3c5846a4a9e","resolution":{"observed_at":"2026-08-06T21:54:44.166053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.170769Z","title":"Trends, applications, and challenges in human attention modelling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.170769Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d09b3f6f02e6d3918d155f59055a35ca5b304eb921ddd2db64406a607541f572","observation_id":"f89498cb-3606-48ef-a8ed-f1e89445c528","resolution":{"observed_at":"2026-08-06T21:54:44.170769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.181293Z","title":"Sharegpt4video: Improving video understand- ing and generation with better captions.NeurIPS, 37:19472– 19495, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.181293Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1daad812978372e17d5527d77e29ac9966f7b06274dee552823e74eb88fdd468","observation_id":"8d1e3c03-7b2c-482f-87db-ac827298ecd7","resolution":{"observed_at":"2026-08-06T21:54:44.181293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.188186Z","title":"Air: At- tention with reasoning capability","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.188186Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7072236aad28ba21bb64a7dc452b7f17c2de76090fcfed9d528bbb31a6250d03","observation_id":"3f739249-8b0b-405e-a512-40d962802869","resolution":{"observed_at":"2026-08-06T21:54:44.188186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.194381Z","title":"Gazexplain: Learn- ing to predict natural language explanations of visual scan- paths","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.194381Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:75ac23c84ba698e6f322b1113abf740837bfe3515e5a85ed563df57a2ae90925","observation_id":"9039b1c1-c39e-401b-b6e0-231cd90266f4","resolution":{"observed_at":"2026-08-06T21:54:44.194381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.200943Z","title":"Fblnet: Feed- back loop network for driver attention prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.200943Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1853c5535b50befc99c163453aecdebe649fcaf921da661d062bd94da6e7a681","observation_id":"fa3db6d1-915a-4f04-8afa-e66ca902494d","resolution":{"observed_at":"2026-08-06T21:54:44.200943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.205400Z","title":"What do you see in vehicle? comprehensive vi- sion solution for in-vehicle gaze estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.205400Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8f6797bc951da69579efbd618d87a57c8536461a83c0d50086c667a9b8d99442","observation_id":"fb72018a-8ddb-4fcf-b501-2e24ac760b02","resolution":{"observed_at":"2026-08-06T21:54:44.205400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.209992Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.209992Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d267d88abdbebee999d80d44a91f08477992c8775812300ece0023a69c792032","observation_id":"9d1b0718-a4cc-4c99-8e07-060775584eff","resolution":{"observed_at":"2026-08-06T21:54:44.209992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.220522Z","title":"A survey on multimodal large language models for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.220522Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d68ce946510d24b4ff38ff9b3245bfb9562247c9114df8e27e5ccb18e835e70c","observation_id":"88af4eaa-3701-4aae-ba3d-0ad575c8aebf","resolution":{"observed_at":"2026-08-06T21:54:44.220522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.225629Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.225629Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e1ba94f4ee7d45c770b3907c896dfa1f1a036cbc4fd6a486a3311a0cbd7ae5c4","observation_id":"80ef0ea1-1cd2-4c59-aee1-0192b087a3b3","resolution":{"observed_at":"2026-08-06T21:54:44.225629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.230387Z","title":"Driving vi- sual saliency prediction of dynamic night scenes via a spatio- temporal dual-encoder network","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.230387Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:615911126d767324988477aabcc0e3960923ace3d5c7852ce24384b82023b89c","observation_id":"c17f3591-d798-477e-9920-f55b39e894fc","resolution":{"observed_at":"2026-08-06T21:54:44.230387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.233930Z","title":"Fbnet: Feedback- recursive cnn for saliency detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.233930Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:681079630094b00836b4f1bd1e1b8694b50c401d563cf72512236b72301801db","observation_id":"1d66e6fa-b170-4c62-936c-0d988a791a60","resolution":{"observed_at":"2026-08-06T21:54:44.233930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.246616Z","title":"Visual saliency predic- tion using a mixture of deep neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.246616Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1437de1052cd75d2d25458fbd921708eb301b8c021ac78eaae753ca65b725946","observation_id":"6a28db98-cb5c-4e92-8c85-b447339f9863","resolution":{"observed_at":"2026-08-06T21:54:44.246616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.250892Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.250892Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8bd4a01dc52770259b67bcdd52088672d0e284bf9f185c78f8f5a0b411496259","observation_id":"20de09e0-2af1-4a56-9054-b9b9b840367c","resolution":{"observed_at":"2026-08-06T21:54:44.250892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.255406Z","title":"Dgaze: Driver gaze mapping on road","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.255406Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1fdd2fd85f0789ce970576f2408bc1df00b1e971c2fa5368f458ba6973bb719f","observation_id":"5bdbbaee-ec34-41f8-a64e-4fb7ef15666a","resolution":{"observed_at":"2026-08-06T21:54:44.255406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.260179Z","title":"Dada-2000: Can driving accident be predicted by driver attentionƒ analyzed by a benchmark","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.260179Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:fe59ec251b91478f2be65a81fa84a270df598eadbf05debd8529e45463e36b60","observation_id":"bc112f50-667e-42ab-851a-0087ccdbca8e","resolution":{"observed_at":"2026-08-06T21:54:44.260179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.265618Z","title":"Dada: Driver attention prediction in driving accident scenarios","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.265618Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3086e1a4abc913cf300de03bf64813a02fecf7c6e28fcc80bec419623b5229e8","observation_id":"89ae88b2-f908-4e55-85c0-f20a6454fe32","resolution":{"observed_at":"2026-08-06T21:54:44.265618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.095513Z","title":"Driver attention pre- diction based on convolution and transformers","venue":null,"work_id":"7464e37f-70ba-492b-8b8e-40cb986490a0","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.269949Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:c4442055b799005428fe8b3c6e4f7226544eaf7328b19c104ce9171962a5babb","observation_id":"7e47df24-3d8c-49ce-b4bf-76e23d3b8210","resolution":{"observed_at":"2026-08-06T21:54:46.099060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.048514Z","title":"Cascade learning for driver facial monitoring","venue":null,"work_id":"106157d3-9e46-474a-a4cb-637a6c2f3290","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.274654Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:40f737fa5e967f7a7a7f257e625b2d0a16189cd135d9300a4e2a98399e3475fb","observation_id":"1a3df834-ef26-42c8-b19e-38104cbc46c2","resolution":{"observed_at":"2026-08-06T21:54:46.066528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:46.022790Z","title":"Graph- based visual saliency","venue":null,"work_id":"218cc68d-d2d5-4593-8216-ca7f28993b8d","year":2006},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.280463Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d5fb2c50a02352775d26dbc559ef7ffdeaf977cd738fa915a3d6ca3156c06d22","observation_id":"54a751a2-2190-4282-bea2-f003b25237ff","resolution":{"observed_at":"2026-08-06T21:54:46.037112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.971606Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"98791db7-43f4-449c-a351-572f803453d2","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.290795Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e4c93e9cae56a953289cab75c42db50014d86925f1734f29760c7141d3bb30f3","observation_id":"7f248076-f684-4952-a91e-d0eb017e7707","resolution":{"observed_at":"2026-08-06T21:54:45.981085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.955372Z","title":"Data-driven estimation of driver attention us- ing calibration-free eye gaze and scene features","venue":null,"work_id":"8fc55a31-ec9c-4803-9452-c218256594bf","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.295838Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8800a18053bbc1d90e5ef8d9f327ad6e1008882d1a2e25036b73e34b8200f5b8","observation_id":"6e7a7786-8679-4744-ab68-77f31ffc19db","resolution":{"observed_at":"2026-08-06T21:54:45.958793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.945314Z","title":"A novel heterogeneous network for modeling driver attention with multi-level visual content","venue":null,"work_id":"c90c0985-7709-45d0-8d5b-70906d7fb9e4","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.301877Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e69b1dbdef4df894e96d1f36ed6b06518eb44a8daec68f3ebcbb3f3a8d343e0d","observation_id":"fc1b4b57-a3dc-44b0-a09d-363f8d835fb0","resolution":{"observed_at":"2026-08-06T21:54:45.948673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.935212Z","title":"Predicting gaze in egocentric video by learning task- dependent attention transition","venue":null,"work_id":"d5d689a0-b909-404a-b7dc-0016c0231f47","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.305929Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3cd1e34fa97ca573a161eac08f5aec794d40ab7215b1ab5dd393574178cedf79","observation_id":"3de02d1f-846f-4e50-946d-373943223d27","resolution":{"observed_at":"2026-08-06T21:54:45.938486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.924470Z","title":"Task-oriented scanpath prediction with spatial-temporal information in driving scenarios","venue":null,"work_id":"d4c988e7-a7a5-4c4c-9154-89d4631a0da5","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.310441Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:dc3121fd2ab17a170114a94bb99a62870cf7bc6da70c0760c3e47519de7dcbce","observation_id":"b471f1d8-f245-4acc-acd6-74de3aa065a3","resolution":{"observed_at":"2026-08-06T21:54:45.927754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.914121Z","title":"Driver scanpath prediction based on inverse reinforcement learning","venue":null,"work_id":"a0dc2cc1-ec53-4186-bebb-dabe85eab3af","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.314583Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7dc1b22bf1cc346195dc5437254195915e90bfd9950b181914ddc6226f985e46","observation_id":"6f58656d-5856-41ba-93e5-9ed270c8c8b5","resolution":{"observed_at":"2026-08-06T21:54:45.917871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.903825Z","title":"A model of saliency-based visual attention for rapid scene analysis","venue":null,"work_id":"e14ee142-0de5-4879-bf30-2fc181ed348c","year":1998},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.319112Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2e4f61c88acead353222842451cb1d5593d1b95467019c539b669f89b92c2b71","observation_id":"04f3d564-6548-4003-8f08-612ef3120757","resolution":{"observed_at":"2026-08-06T21:54:45.907219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.889762Z","title":"Mtsf: Multi-scale temporal–spatial fusion network for driver attention predic- tion","venue":null,"work_id":"1dec0425-d48a-417f-8b4b-c1b47d8305bf","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.323289Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ab833e8900702d92a27b8fc3d82c6f50ae5eac09a1548cd15d4934196d5c21e8","observation_id":"63b4b38d-fbec-46f8-9e01-ef83d247fa4c","resolution":{"observed_at":"2026-08-06T21:54:45.893372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.876898Z","title":"Look both ways: Self-supervising driver gaze estimation and road scene saliency","venue":null,"work_id":"4822f322-a387-461e-ba9f-16070b681667","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.327855Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1676230d7d4813749329ac5c367fee8a98f8a3c607a6636daf29585c3c9b1dd0","observation_id":"36d10da3-da3a-490b-9ad1-ba2fa7e94202","resolution":{"observed_at":"2026-08-06T21:54:45.881023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.866550Z","title":"Attention for vision- based assistive and automated driving: A review of al- gorithms and datasets","venue":null,"work_id":"71eda705-be90-4d60-9bcb-336a560a6180","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.332148Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:be5f120ee052961c7d4af13c6a92f389780fd472e419f45c2d8c1d87a3114ddf","observation_id":"d5dc8cce-b521-48c3-8d25-7439ac4498c4","resolution":{"observed_at":"2026-08-06T21:54:45.870013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.856994Z","title":null,"venue":null,"work_id":"c1f53eac-570f-49fc-a04c-8e8aa1159877","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.337321Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1482b8bd7997c44a4b694227f562dcb729358585a9e23df7191f3ae40b002423","observation_id":"dc66b36b-62a6-44f0-811b-ece695c538bd","resolution":{"observed_at":"2026-08-06T21:54:45.860223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.847118Z","title":null,"venue":null,"work_id":"91c878a4-64b3-4249-b5ba-a44b7398c7ee","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.341614Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:410ad7a111fc263335af89b464e449297f106bdb08f0de8cd2f027d05b0e5ac9","observation_id":"dd8d3282-5289-4342-99a8-036bb676717f","resolution":{"observed_at":"2026-08-06T21:54:45.849965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.836772Z","title":"Deep gaze I: boosting saliency prediction with feature maps trained on imagenet","venue":null,"work_id":"983d8b0d-be61-40c2-8e7b-51a6e124fd56","year":2015},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.359755Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:27838157b456f9eb13c320705d746b9d0a5459823d3cc361792a8cef05c62d17","observation_id":"1b924d11-73d4-43ec-8b87-442b2fabf772","resolution":{"observed_at":"2026-08-06T21:54:45.839972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.370824Z","title":"Lisa: Reasoning segmenta- tion via large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.370824Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2121344b8cd12e298bf2ccb58f3fe9ea161ecdc1c755ac9f479c6102924916c2","observation_id":"9fbe9f17-ab0f-431d-884f-65c5635d8fa6","resolution":{"observed_at":"2026-08-06T21:54:44.370824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.384226Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.384226Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:36de939938a8a30575d4ebf5612db8cfd0edb5a873a32d7546d16f788c6c5f00","observation_id":"4d10f130-362f-4f92-9c2a-a175afa641a8","resolution":{"observed_at":"2026-08-06T21:54:44.384226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.809869Z","title":"Adaptive short-temporal induced aware fusion network for predicting attention regions like a driver","venue":null,"work_id":"feba00be-4be0-41a5-b586-d834c2c5471d","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.388547Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ad56beb95a0a6b9f62145ad38dc8d91e0cc165037cf4c14798bbb1825092dee0","observation_id":"62d80d2d-9b23-4de5-9779-8e79ba406d35","resolution":{"observed_at":"2026-08-06T21:54:45.813492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.798372Z","title":"Lmeye: An interactive perception network for large language models.IEEE T-MM, 26:10952–10964, 2024","venue":null,"work_id":"13e21c44-841a-44f3-93ab-159d4a4af1c1","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.392863Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:946347614bc5042c4ea601398dbb8a6d7b9c4c2cbe2a54aa34b1fc0a018dc9bf","observation_id":"ecff9b98-6fa9-405c-b631-a8338059f811","resolution":{"observed_at":"2026-08-06T21:54:45.802370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04921","snapshot_observed_at":"2026-08-06T21:54:44.397750Z","title":"Perception, reason, think, and plan: A survey on large multimodal reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.397750Z"},"links":{"cited_paper":"/paper/2505.04921","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:5825136f141f05d6fb31989c891843ad42acd9d5f45ec6075cc69d57dac71955","observation_id":"8bb93239-230e-44fd-a208-d7405e69ce61","resolution":{"observed_at":"2026-08-06T21:54:44.397750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.785835Z","title":"Airvista: Empowering uavs with 3d spatial reasoning abilities through a multimodal large language model agent","venue":null,"work_id":"4e2cc413-c17c-451e-85be-75026d7bbf53","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.404740Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:5186ab8e5161c2252def9868ae2652c0063c505877ec787f7b06af4ad914fe9b","observation_id":"6870f5da-20b4-482a-83eb-3bbfa1b3acbf","resolution":{"observed_at":"2026-08-06T21:54:45.789642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.772233Z","title":"Deepgaze iie: Calibrated prediction in and out- of-domain for state-of-the-art saliency modeling","venue":null,"work_id":"569e02a7-e1b0-444d-8afd-67ac21c12cd0","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.409062Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0063f764e372d1591a94c62dec6e7997560d9d2180d2b59bd163aee0e34064a7","observation_id":"8f4ec173-0804-4759-9245-fdf382400fc9","resolution":{"observed_at":"2026-08-06T21:54:45.776757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.756843Z","title":"Visual instruction tuning","venue":null,"work_id":"2694d736-204d-40e0-beff-5c20390e2f58","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.413033Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d3330d39a52a0b0243ca6a256596fce909a24b576d0bed6f2fcca5c26d3654c3","observation_id":"3b3861d4-d21d-40bc-8971-72e47f204a60","resolution":{"observed_at":"2026-08-06T21:54:45.761434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.417212Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.417212Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:70e49e5e853f9b09db6ce278bba8b47aae21948c146e79593c0c5ce867ff43e9","observation_id":"e75aefff-8425-42f3-b062-f1606deb299b","resolution":{"observed_at":"2026-08-06T21:54:44.417212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.736809Z","title":"Goal-oriented gaze estimation for zero-shot learning","venue":null,"work_id":"acd62b9e-85c5-4e07-b4f3-092839d9b2fe","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.422689Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:46a71ed922a529781f7865cbcd552bfab7e028f04161c6d2a036dc0fa943cc92","observation_id":"e07f0767-cdd8-4ae4-9b0e-13c5d9f620f0","resolution":{"observed_at":"2026-08-06T21:54:45.740253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.726377Z","title":"A convnet for the 2020s","venue":null,"work_id":"5f0494c0-3bc1-48d1-95e6-a30713cd9b99","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.427088Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d9c2bec53f79b98da2528e0bc86ac3664493637b9947c4d4bdf95f310d8498e6","observation_id":"9badef32-cc9b-4d5b-9219-c72efea54d34","resolution":{"observed_at":"2026-08-06T21:54:45.729942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.706408Z","title":"Robollm: Robotic vision tasks grounded on multimodal large language models","venue":null,"work_id":"09acdd51-23b5-4bd1-b40c-174c1ad57ab8","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.431477Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:35d702de6c8d97a03a717fda4d8c6b075600408756d8cc8895f5f89e968156a6","observation_id":"306a245d-8c51-4678-a190-dc89458a55b1","resolution":{"observed_at":"2026-08-06T21:54:45.710903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T21:54:44.436055Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.436055Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6f6e02b3a66d2bfdaca0e2a25c48ac0c3e3a5f9221a11127ff6449ac26411f55","observation_id":"91971b2b-a0c0-49b4-b778-53660c65f5ad","resolution":{"observed_at":"2026-08-06T21:54:44.436055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.691700Z","title":"Gaze and eye- tracking solutions for psychological research","venue":null,"work_id":"5a32f0b8-2b7e-4cb5-84cc-220e72b8b620","year":2012},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.440853Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:84c4eb67f58dab97b274db3c4246e9a61a9c68f5fccd6528e97ae7dafabed865","observation_id":"84838941-97c9-4eec-80b6-125e20dc395f","resolution":{"observed_at":"2026-08-06T21:54:45.696789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.677864Z","title":"” looking at the right stuff”-guided semantic-gaze for au- tonomous driving","venue":null,"work_id":"eb33aab8-b3ef-464e-a67e-8604a0eaf5dd","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.444977Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f0ff132100a9f377ee9abe24e1e30decfb1ded6fcb76a2bfc71b3d6f53a6c234","observation_id":"9c8bc8ce-0f79-4ee7-8006-4942198e7a22","resolution":{"observed_at":"2026-08-06T21:54:45.681808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.665413Z","title":"Predicting the driver’s focus of attention: The dr(eye)ve project","venue":null,"work_id":"460fc8f0-81f9-4495-9e57-6388b2fd49d6","year":2019},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.449579Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:dad3981b5aa189d8d8fbfbc23cedf3442cdb926775d8d4515941a1a2dd16161d","observation_id":"bdc1beee-94ac-44be-842e-5770cff1fefd","resolution":{"observed_at":"2026-08-06T21:54:45.671022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.654000Z","title":"Multi-scale interactive network for salient object detection","venue":null,"work_id":"9727440a-114f-4e6a-8b3b-302c9d35fe1d","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.454167Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:9fa00672922ec91f37f60f442e4dadb604d67f7be749962b9145c7ad469450c0","observation_id":"fe9038c6-f9cb-4ead-a5ee-8fb8944b948c","resolution":{"observed_at":"2026-08-06T21:54:45.657858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.639476Z","title":"Human generalization of in- ternal representations through prototype learning with goal- directed attention","venue":null,"work_id":"27e04971-b70c-4e20-959b-a3961ac560d8","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.458500Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d3c6c51a11e46dc8157c12aab932c1ad306d21369991df327902d3a560242a45","observation_id":"e4452014-1fcb-4688-acde-7287beb21c3c","resolution":{"observed_at":"2026-08-06T21:54:45.643861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.627651Z","title":"The attention sys- tem of the human brain","venue":null,"work_id":"dfa4a98d-1bbf-4452-8f1b-0f6e49e003ec","year":1990},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.463166Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:a1d3961bdf80e37a025736c8ee1289696870875e0f4272756911d8ab2911b7e4","observation_id":"1b7af59e-0227-4e68-8f30-ca724916857f","resolution":{"observed_at":"2026-08-06T21:54:45.632070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.613975Z","title":"U2-net: Go- ing deeper with nested u-structure for salient object detec- tion","venue":null,"work_id":"bf89f7e9-838d-4cf1-8ec1-18651ab0c06a","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.467943Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:14aa15b957d86cb9e1db392ed4e7098178365431b68ef44db9655cb17cd90482","observation_id":"019f6a9d-3150-4f34-b125-2529b18c2b53","resolution":{"observed_at":"2026-08-06T21:54:45.619477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.602061Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"94267e3b-e1f1-45d3-b735-75e88b84b884","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.475388Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:dcf7d3ad498e3a7ebc79befa533d15d21ea77ab1804909885a59297ae1dd7e8a","observation_id":"e56c61c2-a998-4eb8-9964-82d6443aa36a","resolution":{"observed_at":"2026-08-06T21:54:45.605542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.582386Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":"908aa0c0-eb19-438e-bfa4-6253c720bf29","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.484081Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:6cd6e23ad6b9a7dfeba19baf39c11abbe49ca942fe184c180dac1dd9e2294d2a","observation_id":"22d1aa9a-8b3d-472b-a68f-159ccb90ffff","resolution":{"observed_at":"2026-08-06T21:54:45.588857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.557883Z","title":"Pixellm: Pixel reasoning with large multimodal model","venue":null,"work_id":"7712d3ae-854d-4d0f-b30c-db679121589f","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.493000Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f4b8cf39066ba706123f0939d3e35d25e0ddb9a465c5d5053f0ddb57dd773181","observation_id":"950306ac-6ef9-4a97-a0dc-b5c5f54729e6","resolution":{"observed_at":"2026-08-06T21:54:45.565437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.538981Z","title":"Weakly supervised fixated object de- tection in traffic videos based on driver’s selective attention mechanism","venue":null,"work_id":"da940df1-b93b-4dff-911f-19cf657fb856","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.498070Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:514d3ff96064e66b89c3dac1fc37406d9433e104d35d966a87962edcdbcea603","observation_id":"0aa343c6-5ba4-43cd-9735-96f35d3d0ebc","resolution":{"observed_at":"2026-08-06T21:54:45.542462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.525569Z","title":"Fixated object detection based on saliency prior in traffic scenes","venue":null,"work_id":"b60eb379-526d-49ee-a7c1-a64359720200","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.503189Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:f0fcfca4786bf5523cfb286c25e06c1c1c966e89eb0a9c3789d847609b55d76f","observation_id":"fef69091-3117-40cf-8dde-db2c1f0482dc","resolution":{"observed_at":"2026-08-06T21:54:45.529339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.507766Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.507766Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0db3fcad595faabf76cde9f5cb23385186c5a6b3851543e6f9bdccdbe4231834","observation_id":"46052145-756a-4902-aacc-3ca678f71655","resolution":{"observed_at":"2026-08-06T21:54:44.507766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.507054Z","title":"Vitgaze: gaze following with interaction features in vision transformers","venue":null,"work_id":"69033310-d0c0-4e10-9b07-a2762dc69218","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.512761Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:c584b1551064f7486e78dc2a2e4d6a803282a17f98cf409ffc79aa38ab52d65a","observation_id":"cab3639d-c77d-4818-8586-87ab5b259610","resolution":{"observed_at":"2026-08-06T21:54:45.510485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.493957Z","title":"From gaze perception to social cognition: The shared- attention system","venue":null,"work_id":"bbc6b893-aefc-4a25-9908-5a675f00bcb7","year":2021},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.517285Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bba1286a00cb4cfa85b14a2915a57a8b02f273f9a668b4e50e96b39314625890","observation_id":"10a34077-6cc4-4f60-95b9-1f77e319de16","resolution":{"observed_at":"2026-08-06T21:54:45.498167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.479226Z","title":"Driving as well as on a sunny day? predicting driver’s fixation in rainy weather conditions via a dual-branch visual model","venue":null,"work_id":"b81e2226-342c-4ef3-9f5c-3b68305d00f7","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.521757Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:20c7688ae57c2d196511f70742fb4fe4ed861badea992fdf7adc893092e4024b","observation_id":"370bb2b4-6473-43b9-bc8f-0bffb72e69af","resolution":{"observed_at":"2026-08-06T21:54:45.485732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.450624Z","title":"Drivevlm: The convergence of autonomous driving and large vision-language models","venue":null,"work_id":"b4e40cca-1282-4a61-ab2c-784fcad429be","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.526974Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:4739fda1ee4d7111e952074627f1204339a71877981bb98de80be950abb17cb9","observation_id":"5f6ebc63-00a0-4523-9d1a-626a8cf04d72","resolution":{"observed_at":"2026-08-06T21:54:45.458971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02341","last_updated":"2025-03-25T15:55:33Z","snapshot_observed_at":"2026-08-17T01:27:03.129764Z","submitted_at":"2025-01-04T17:32:12Z","title":"UAVs Meet LLMs: Overviews and Perspectives Toward Agentic Low-Altitude Mobility","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02341","snapshot_observed_at":"2026-08-06T21:54:44.530817Z","title":"Uavs meet llms: Overviews and perspectives toward agentic low-altitude mobility","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.530817Z"},"links":{"cited_paper":"/paper/2501.02341","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e758bd6cd114d1c3f3bf367fe7cdb9bf86d0d30fad352e8188ff8d694e93b0f8","observation_id":"6066adc1-b3c8-4ffa-a8af-7f8561261a5d","resolution":{"observed_at":"2026-08-06T21:54:44.530817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.437372Z","title":"Next-gpt: Any-to-any multimodal llm","venue":null,"work_id":"f2452145-1c72-4b1b-aa12-a7adb397bb87","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.535548Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:87b98e8b799295dd7bb87ab55de77d16c3547dcfe98b9134735930930a20e623","observation_id":"d4f59f64-f440-4cd8-840b-13bf5b14b6ec","resolution":{"observed_at":"2026-08-06T21:54:45.441076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.426759Z","title":"Predicting driver attention in critical situations","venue":null,"work_id":"6af0bfc0-ce27-41a3-ae77-b068c0951d5c","year":2019},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.540153Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2eb23dcd43cbe11844ce8f6e1d3bf195879772b36f6717784a85f2e85c89d30a","observation_id":"5d6f4106-16bc-4861-ae0d-5d2c6d2b43f0","resolution":{"observed_at":"2026-08-06T21:54:45.430147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.415725Z","title":"Gsva: Generalized segmentation via multimodal large language models","venue":null,"work_id":"83ef47f4-367b-4e10-98f0-ec99dc42516a","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.545053Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3a4b99cccda05ab44f5377aa7a3efb0ca0d66e5c8bbbbc1293eaebcaea3c3e61","observation_id":"9291d7e7-e413-4dbd-9f4d-e46ad58d657a","resolution":{"observed_at":"2026-08-06T21:54:45.419000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.405816Z","title":"Pyramid grafting network for one- stage high resolution saliency detection","venue":null,"work_id":"00265c05-6271-43bd-bd9e-a659c88ada37","year":2022},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.549422Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7bfe939e9b9dafd7e346da85924f5da1b75358f673dbe9321542f197cb4a0762","observation_id":"e0372360-af20-437c-b9de-8b1b0ef71c91","resolution":{"observed_at":"2026-08-06T21:54:45.409325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.394541Z","title":"Transconvnet: Perform perceptually relevant driver’s visual attention predictions","venue":null,"work_id":"3fc11ada-a3ca-4fc5-b80a-8044914c3fc9","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.554686Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d7595ea9ffa9580f4db164b524373f0abde709976cf4e332391be92ef2c1ebf4","observation_id":"1d6d90fc-d6b2-40d6-9ebb-b66f5c1b0d4c","resolution":{"observed_at":"2026-08-06T21:54:45.398196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.370435Z","title":"V oila-a: Aligning vision-language models with user’s gaze attention","venue":null,"work_id":"1455e3e2-c8b8-4423-88ea-8e4497d2c794","year":1918},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.559347Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:de76338d3d15ed631f03f6b5c112f2ca1e387cf3ef376a6bdf9de71df3883ca2","observation_id":"164c9033-1f92-4574-a163-09919c696f90","resolution":{"observed_at":"2026-08-06T21:54:45.380753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T21:54:44.564724Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.564724Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:da5b71e1339664d33ee7d8e4314d2bf47208afed0e314f6c318e07940bc4359a","observation_id":"a334305d-1024-4107-8664-3ae272bc466a","resolution":{"observed_at":"2026-08-06T21:54:44.564724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.346588Z","title":"Progres- sive adapting and pruning: Domain-incremental learning for saliency prediction","venue":null,"work_id":"a0578a81-5561-4fd5-b419-ea23297259c6","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.569548Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:bedb86b81bf6ed77786911743b98aa3f3ebdf3c04f3b7e636970b61f78011331","observation_id":"80d35fea-a602-4f8a-b83b-5bbb5b33c354","resolution":{"observed_at":"2026-08-06T21:54:45.356959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.317138Z","title":"Continual learning with bayesian model based on a fixed pre-trained feature extrac- tor","venue":null,"work_id":"2ec1b2f7-7b30-4ed4-b856-673541553c4b","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.574798Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1192401dae745f41b90486ac182b5736a9827dc3ec70e97150662404e3fbf340","observation_id":"98a82185-79bb-4072-be07-61b92b7c05fe","resolution":{"observed_at":"2026-08-06T21:54:45.331574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08548","last_updated":"2026-04-05T00:57:47Z","snapshot_observed_at":"2026-07-06T21:23:14.666121Z","submitted_at":"2025-05-13T13:20:46Z","title":"From Seeing to Doing: Bridging Reasoning and Decision for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08548","snapshot_observed_at":"2026-08-06T21:54:44.585590Z","title":"From seeing to doing: Bridging reasoning and decision for robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.585590Z"},"links":{"cited_paper":"/paper/2505.08548","citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:25b604a6f67f92f732d2ddf7efb3b2a829e9a5cb1e376a57a37fdcbf69402566","observation_id":"ef3d09d7-f497-4577-82a8-847830dce81d","resolution":{"observed_at":"2026-08-06T21:54:44.585590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.294111Z","title":"Contextual object detection with mul- timodal large language models","venue":null,"work_id":"a4116d73-ee2e-49b9-a310-d63c472fee6b","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.591060Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:9cc91da120003f3ae9add28a958748e1d5d1d03fe44dd2b1def5c128ad0bf602","observation_id":"b6684dba-fb82-407f-8d66-f1b496c62b22","resolution":{"observed_at":"2026-08-06T21:54:45.301203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.258327Z","title":"Da-bev: Depth aware bev transformer for 3d object detection","venue":null,"work_id":"685ee64b-cde0-4d20-a741-05937a2f1180","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.595775Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:092d58e43e8018b24d27f64fd911925623f8a05e66e55107901dd655a7770774","observation_id":"38e10db4-c9e5-4506-8851-4e3edc207b2c","resolution":{"observed_at":"2026-08-06T21:54:45.262728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.220828Z","title":"Llava-grounding: Grounded visual chat with large multimodal models","venue":null,"work_id":"8f9ac167-e4cb-41ab-8a17-8a9d7ce95110","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.600597Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:fb8a5fe1c13e3472a0dfa97b479e9f9eb27e3b052b7a9f79ac571587c7b04c5e","observation_id":"169c3061-baab-4a56-b592-8001d0d49204","resolution":{"observed_at":"2026-08-06T21:54:45.235455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.203713Z","title":"Human gaze assisted artificial intelligence: A review","venue":null,"work_id":"1ab584c4-97af-42e8-9ec2-ec416f229b02","year":2020},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.606358Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:b8f834269ec5a37b659e9ca900178e31f518b04e122b6d07f0cbd0e071d119df","observation_id":"36f5fa3b-fea7-40b2-90f3-6c4282aeb66c","resolution":{"observed_at":"2026-08-06T21:54:45.208857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.177487Z","title":"Salm 2: An extremely lightweight saliency mamba model for real-time cognitive awareness of driver at- tention","venue":null,"work_id":"01c630e2-fbcb-43e5-b695-364bdd89b677","year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.610759Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:e96616c519daa16c44e93127de2054dd8a4987c0afc836afc7b85d51a295a91f","observation_id":"1f614c2c-5c4b-431e-aab5-337bcd4472e0","resolution":{"observed_at":"2026-08-06T21:54:45.191337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.148389Z","title":"Learning from easy to hard pairs: Multi-step reasoning net- work for human-object interaction detection","venue":null,"work_id":"01770a5a-e85c-43af-a4a3-577e2742ee5c","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.614951Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ab1e706bf6160045f1475437f6f645dd1b958f0a4c6368f19aada1a214325ead","observation_id":"5dae4df3-646e-473b-94f1-e13e8a6e881a","resolution":{"observed_at":"2026-08-06T21:54:45.155705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.135705Z","title":"Pit: Progressive interaction transformer for pedestrian crossing intention prediction","venue":null,"work_id":"dba0d85d-3c94-44b7-9688-29338c4f3c7a","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.619453Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0c9ea0be3ffa298a341faa64914f2f159abd2831d1772f95bb7e583f899b4ab1","observation_id":"a2e13276-819c-456b-8d98-ed15d1d512eb","resolution":{"observed_at":"2026-08-06T21:54:45.140318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.114885Z","title":"Learning from observer gaze: Zero-shot attention prediction oriented by human-object interaction recognition","venue":null,"work_id":"95832206-4d82-4588-9471-d581abdf98d4","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.623813Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:46017421cba2511e9f57abaa1330e254902e7ef2ef12afab03c06f06aafbc2a1","observation_id":"1b0a98c9-12c4-4f25-8ef5-30d10c87c989","resolution":{"observed_at":"2026-08-06T21:54:45.127918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.088259Z","title":"Hktsg: A hierarchical knowledge-guided traffic scene graph representation learning framework for intelligent vehi- cles","venue":null,"work_id":"4081c7e6-553c-4419-8b11-357fe0daabde","year":2024},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.627225Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:d3fb76e549c1f4b69db90fcc42a8f574494c238ebad9c1553989831fc8984d12","observation_id":"c43fe3a8-de0a-48a0-8248-64d179e58f84","resolution":{"observed_at":"2026-08-06T21:54:45.092545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.073938Z","title":"Behavior-aware knowledge-embedded model for driver attention prediction","venue":null,"work_id":"4c36b418-3b63-4e72-8672-9e406d371c18","year":2025},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.632018Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:4670549c508016158af222236b895012d01a6bb5ab3e017cd3260c802c648b32","observation_id":"60dd76c5-ca3c-46e9-8b7f-8548688748c4","resolution":{"observed_at":"2026-08-06T21:54:45.078981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.055298Z","title":"Unsupervised self-driving attention prediction via un- certainty mining and knowledge embedding","venue":null,"work_id":"41115d86-ace3-4e2c-947a-97429e265c59","year":2023},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.636808Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:47711404dc0b398afd33deaf577b7dd180618fae905ae6e66e8890d35ca8c78c","observation_id":"644f177b-9166-4c05-9799-9c8246e69717","resolution":{"observed_at":"2026-08-06T21:54:45.064755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.041349Z","title":"Dataset Comparisons To highlight the advantages of W³DA, we compare it with existing driving attention datasets, as shown in Table 4","venue":null,"work_id":"498df04a-f52d-4a5e-8de0-46368fa92713","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.641824Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:2ec38532e06b3be07028351c81bbba2d532d32df6303e2405a64453538e9e514","observation_id":"2623f5f0-0ece-46d3-ba68-72a87b5a19b9","resolution":{"observed_at":"2026-08-06T21:54:45.046030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.025215Z","title":"road ahead","venue":null,"work_id":"56a5a4e2-6b27-4dbc-9fee-0a932d3bb27b","year":2000},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.646512Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:7f3f28d4c8af696205bf4c8b29d2827176cc78ff5c9deda728da4ebd45e769c6","observation_id":"0af0ad5b-7b32-40da-b466-a8bcca0579e1","resolution":{"observed_at":"2026-08-06T21:54:45.032042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:45.002951Z","title":"The image shows your visual attention distribution","venue":null,"work_id":"daaa6e4b-1180-4c55-8715-72032805d673","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.652368Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:cd7239b52cdc7d47e0e84dcdfcd791327df2d3739cc2ee8f435dffdc5fda2f25","observation_id":"1d447fc1-ee9d-4fb9-94f2-5d0144744f5c","resolution":{"observed_at":"2026-08-06T21:54:45.014518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.944286Z","title":null,"venue":null,"work_id":"b0908ea4-596a-4044-91e3-e62d7f51fd0d","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.665747Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8fd933546bc5b65ea97e394e9a586ae650b2ddd1a769f8bb427327e9d258f742","observation_id":"dec0f8b0-9a08-44bc-a032-f03032019496","resolution":{"observed_at":"2026-08-06T21:54:44.948238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.894899Z","title":null,"venue":null,"work_id":"d61c3dd5-48c8-43ea-99c0-69e9ea09d4bf","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.681087Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:1c0e5004d5aa9bc616ddeccde5d2a1a8227451a5ed11c36fab350917b5519171","observation_id":"2b03a403-db9a-4dc5-a84d-f27924dc85c4","resolution":{"observed_at":"2026-08-06T21:54:44.925554Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.877704Z","title":null,"venue":null,"work_id":"a8956169-9032-40ce-9f74-7ed7e76302a5","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.685369Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:0d4a875e0cbef3e0453552cd4d3ca57ea84888ac6f8ad59e32c3aed504a79a81","observation_id":"f833263c-0ef5-45b0-8632-7962b24fe845","resolution":{"observed_at":"2026-08-06T21:54:44.882596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.861987Z","title":"{context_description}","venue":null,"work_id":"b4227cfc-e16b-4449-bae3-0aa61f543e8e","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.693606Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:8c8fb72899d500482cc28107bff89e76ef674c57409049d677181fa7fd394254","observation_id":"8bc9bcd6-74cd-490a-80a0-e37cc8b22a38","resolution":{"observed_at":"2026-08-06T21:54:44.867479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.843128Z","title":null,"venue":null,"work_id":"0a402081-0877-44c8-8109-1dac76dd338d","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.698703Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:ccc8ddb6ef8a8bea6a9f86ed4f7444f5f29cb47bbffb5f268f9bb41bd3335584","observation_id":"17acad4d-bd01-465d-b7d7-8646d77dbfbf","resolution":{"observed_at":"2026-08-06T21:54:44.847328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.828380Z","title":"Prompt templates for MLLM annotation in traffic accident scenarios","venue":null,"work_id":"1aab399d-eb5a-4acd-978d-24fba1680439","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.704606Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:3edc47f6b62f5f85a5ad1ff149c5e2b80c3a80329d6544b96d91e78a91ab4683","observation_id":"4d6a283a-f6fa-4042-95e4-a79b670d52ae","resolution":{"observed_at":"2026-08-06T21:54:44.834292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:54:44.974031Z","title":null,"venue":null,"work_id":"0cea1ca7-8b4d-4ab1-84d9-5621a1a8f39c","year":null},"citing_paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-06T21:54:44.708764Z"},"links":{"citing_paper":"/paper/2506.23088"},"observation_digest":"sha256:55e1224ebef9017365b851f0ccf5a0c1d4dc39368c7733b5818eff51abffb2d4","observation_id":"522d1564-6a7e-4dbb-9f59-64803517b17a","resolution":{"observed_at":"2026-08-06T21:54:44.983908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23088","last_updated":"2025-06-29T04:59:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T20:17:44.939473Z","submitted_at":"2025-06-29T04:59:39Z","title":"Where, What, Why: Towards Explainable Driver Attention Prediction"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":62},"total_outbound_references":102},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 102 outbound references and 6 inbound Pith citation observations for arXiv:2506.23088."}