{"as_of":"2026-08-20T22:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02b9df3cac7029356d8e28adade740ed709b99028bae20186ea60bac2cf0861a","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:25:06.815723Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16720/citation-record","integrity":"/paper/2506.16720/integrity","json":"/paper/2506.16720/citation-record.json","paper":"/paper/2506.16720"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.147341Z","title":"A crash injury model involving autonomous vehicle: Investigating of crash and disengagement reports,","venue":null,"work_id":"0bd63cf2-9301-4a65-aee0-840a1f2cc71b","year":2021},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.700531Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:d91d3a5dbc2f16a27479466e9a603fa7997bce97616f81b425d931cec11ae934","observation_id":"433c970f-8f7a-42f3-bef9-8c803be4193e","resolution":{"observed_at":"2026-08-15T19:25:07.150966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.136255Z","title":"Anti-jerk on-ramp merging using deep reinforcement learning,","venue":null,"work_id":"862cae2b-0d4c-4840-813a-c2858b197cd1","year":2020},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.704221Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:87330f2bbda5cee50fa0a8d0eda617226c504f8ece1f11c53cf11fb42a7cdf9a","observation_id":"b22efc79-f784-47ab-9bf9-0f443d472339","resolution":{"observed_at":"2026-08-15T19:25:07.140004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.124256Z","title":"Identify, estimate and bound the uncertainty of reinforcement learning for autonomous driving,","venue":null,"work_id":"0543223e-81be-4d41-9f3f-324654cea4ab","year":2023},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.707276Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:be5a4699bae9087e85022e20e09357856bb295885e5d3df9dd633017549dc1bd","observation_id":"4a769e59-d522-458e-8128-d14410edf977","resolution":{"observed_at":"2026-08-15T19:25:07.128325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.710372Z","title":"Generalizing from a few examples: A survey on few-shot learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.710372Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:e2dcbdb44b3d7dd22457629f8ef56115231062a5f614766bbb0592220065368e","observation_id":"3b121b92-28bc-420c-b4bc-f9c2af7a6f57","resolution":{"observed_at":"2026-08-15T19:25:06.710372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.106802Z","title":"Autonomous driving policy continual learning with one-shot disen- gagement case,","venue":null,"work_id":"e252e07f-8ded-4969-93ce-c42b96b051cd","year":2022},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.714144Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:52fd184c82db20e4e87fe1387d438d8ec2ff2348165f720ca0fe212e87e3d8b5","observation_id":"d9514feb-b92a-4394-8fd8-216436924b43","resolution":{"observed_at":"2026-08-15T19:25:07.110274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.718440Z","title":"Who make drivers stop? towards driver-centric risk assessment: Risk object identification via causal inference,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.718440Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:2523e9289c43d4b5e50b3cba686d151eccd99345c0fee3e2faad1cf70fc8a780","observation_id":"25525039-dc33-4486-9716-e552afee0509","resolution":{"observed_at":"2026-08-15T19:25:06.718440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.087949Z","title":"Goal-oriented object importance estimation in on-road driving videos,","venue":null,"work_id":"dea050ac-50aa-4fcb-834b-674a792f2278","year":2019},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.722579Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:0abdbe19cb536c1b00112e57f94408014acd4c8a795ff4a28dd9c8258385cd4b","observation_id":"0e71b49c-9070-44c7-b364-27725d663eea","resolution":{"observed_at":"2026-08-15T19:25:07.092384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.727112Z","title":"Agent-centric risk assessment: Accident anticipation and risky region localization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.727112Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:264403ce1aeac5bc940ad51998a16af7e64c9533409697cfc86abdd0a1b8b744","observation_id":"42548532-94a1-46fe-9dbe-374256757ab0","resolution":{"observed_at":"2026-08-15T19:25:06.727112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.01182","last_updated":"2017-02-03T21:57:13Z","snapshot_observed_at":"2026-08-14T21:18:03.283956Z","submitted_at":"2017-02-03T21:57:13Z","title":"Uncertainty-Aware Reinforcement Learning for Collision Avoidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.01182","snapshot_observed_at":"2026-08-15T19:25:06.731199Z","title":"Uncertainty- aware reinforcement learning for collision avoidance,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.731199Z"},"links":{"cited_paper":"/paper/1702.01182","citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:cbb648c7b10d08ec044e3178f83491329c0ad8bcd8cbf275ed2f0a8babb041b5","observation_id":"6894da82-81b6-498f-83c1-bd85d83570f4","resolution":{"observed_at":"2026-08-15T19:25:06.731199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.067973Z","title":"Confidence-aware reinforcement learning for self-driving cars,","venue":null,"work_id":"72142a74-fa7d-4d8b-94a6-f980e74c9c3d","year":2021},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.735361Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:bcc62e1b0cb3d445290fd8f129fd3b110d52e79a8f42b682c215c8238bcfac3c","observation_id":"704624d6-a5f0-4a33-a006-612947b5cb87","resolution":{"observed_at":"2026-08-15T19:25:07.072254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.054559Z","title":"Uncertainty-aware model-based re- inforcement learning: Methodology and application in autonomous driving,","venue":null,"work_id":"ba87abf0-10cd-47a7-910d-f78a3f3b5b87","year":2022},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.739977Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:88417d69f306b628d52485833bcd03be8689caa58abbaccbc5be9eb239c1459a","observation_id":"a2127f82-b70d-4b0a-8b17-653e0b4028b6","resolution":{"observed_at":"2026-08-15T19:25:07.059349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.044293Z","title":"Learning task-relevant representations for generalization via characteristic func- tions of reward sequence distributions,","venue":null,"work_id":"e357d4d9-0970-4746-a1ec-8f76c5cd22ca","year":2022},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.744245Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:9aa32c1fbff20193f2b5aa2fc606eee3a8d49f49223cbddf85f8566521a5dd39","observation_id":"3b0cdd5a-8082-4559-b3a1-c6d8021e2029","resolution":{"observed_at":"2026-08-15T19:25:07.047772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.032011Z","title":"Uncertainty-based offline variational bayesian reinforcement learning for robustness under di- verse data corruptions,","venue":null,"work_id":"f77a158e-3e91-4238-8d86-1bdf7fd470ff","year":2024},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.748201Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:9527146c26ad8d713e404bbbed900bd1ef5365b7cfb2afb57ac0de3df19e3d56","observation_id":"f16a06d1-741a-4c50-b92c-8ae6b2ff8c9b","resolution":{"observed_at":"2026-08-15T19:25:07.036834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.021040Z","title":"Analysis of accident data for test scenario definition in the assess project,","venue":null,"work_id":"60c207ec-736a-4674-99b9-30ce4947fa91","year":2010},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.752671Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:a44967b9348bf7c143b930d8fc4213f7f721c7615744ee4984683325c7e65506","observation_id":"89bcb1e7-48fc-4757-bc6e-2af87473c339","resolution":{"observed_at":"2026-08-15T19:25:07.024446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:07.008178Z","title":"A comprehensive self-driving car test,","venue":null,"work_id":"02330b2d-1808-43d9-9462-2f66ee963091","year":2018},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.756242Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:a0255ef36fa9ad32d01743f23cbe0e006ee292abeccef862418c515d18d4ea62","observation_id":"7473ded0-c5e1-4c2f-8b52-6f66458d5e2f","resolution":{"observed_at":"2026-08-15T19:25:07.012986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.760091Z","title":"Congested traffic states in empirical observations and microscopic simulations,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.760091Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:b39273f8f07367eccdafe91cefed3e388d328a6507de2c8f6ce180eb0d16b3f6","observation_id":"4ed0539e-8085-4470-8844-eaf370866d5a","resolution":{"observed_at":"2026-08-15T19:25:06.760091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.764312Z","title":"General lane-changing model mobil for car-following models,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.764312Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:0ec2da03e7e78a23d6db321638f166a11ada5445cbb173ddae6725423327c954","observation_id":"ec7045b2-276a-4594-a9c0-7efa33d1f237","resolution":{"observed_at":"2026-08-15T19:25:06.764312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.768187Z","title":"Trafficsim: Learning to simulate realistic multi-agent behaviors,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.768187Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:a54215bbf4f39974066e93658d7034a5970ad4f31f175f238cdebf89d1d6493c","observation_id":"7294dab4-19f7-425c-9386-3aa42dcc1604","resolution":{"observed_at":"2026-08-15T19:25:06.768187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.771907Z","title":"Simnet: Learning reactive self-driving simulations from real-world observations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.771907Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:bc9ef4e0d04d6b557cde525ffb42daefcf28e42c342eeefdb385e453b04456a9","observation_id":"571ff858-837b-478c-ad1b-bb5c90711746","resolution":{"observed_at":"2026-08-15T19:25:06.771907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.963863Z","title":"Overview on deepmind and its alphago zero ai,","venue":null,"work_id":"800541b6-a9e8-42bc-9a40-ead438c1ffe3","year":2018},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.775358Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:8e9fa95644818a68ac0e7bfd1b5208f77b4e73ddc17260d89d1de4d7f786c9d7","observation_id":"98f0a991-b8a7-4812-8fa4-e908bafb28ab","resolution":{"observed_at":"2026-08-15T19:25:06.968006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09601","last_updated":"2023-02-19T15:47:24Z","snapshot_observed_at":"2026-08-16T15:54:18.419667Z","submitted_at":"2023-02-19T15:47:24Z","title":"Generalization in Visual Reinforcement Learning with the Reward Sequence Distribution","version":1},"cited_work":{"arxiv_id":"2302.09601","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.09601","snapshot_observed_at":"2026-08-15T19:25:06.847249Z","title":"Generalization in Visual Reinforcement Learning with the Reward Sequence Distribution","venue":"cs.LG","work_id":"f3074b41-9d46-4d33-a1d6-38948022648f","year":2023},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.778158Z"},"links":{"cited_paper":"/paper/2302.09601","citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:10ac46867bd3720b7dc4cdd9d1676415b208755d3e8d47ee0c59c3a5f137720c","observation_id":"7928db64-357f-4271-af3c-eee27ab63c1e","resolution":{"observed_at":"2026-08-15T19:25:06.853728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.952773Z","title":"Quan- tifying generalization in reinforcement learning,","venue":null,"work_id":"1104e290-6047-456d-804f-e22520ce7f64","year":2019},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.781790Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:5f80523b642779d468db121a58f88e750f33f1dbbb5707ce17beb7704728c5f4","observation_id":"f40060c1-44cd-438e-bf8a-be6d760000a4","resolution":{"observed_at":"2026-08-15T19:25:06.956823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.785153Z","title":"Tra- jectron++: Dynamically-feasible trajectory forecasting with heteroge- neous data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.785153Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:fe94d82c68bcd49d8f6d581e7956410b59447e97a0631973353051cae62c3f08","observation_id":"fe7f7d1e-7406-4774-9fd1-f455fdb79e15","resolution":{"observed_at":"2026-08-15T19:25:06.785153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.787977Z","title":"On estimation of a probability density function and mode,","venue":null,"work_id":null,"year":1962},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.787977Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:be33ac97a275389e75b9ac88ce8b5b1b24e55a016507db2daa8b480103b825c8","observation_id":"28ebbba5-d027-40bd-85b3-d3ad299a7a31","resolution":{"observed_at":"2026-08-15T19:25:06.787977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.791551Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.791551Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:66cb187fdb07309a9bc3092bab03b4dd91ecd936ce675c249d6516bea262033f","observation_id":"fb5664ee-45ce-4fdd-a5ad-580205436f95","resolution":{"observed_at":"2026-08-15T19:25:06.791551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.920359Z","title":"Lane change and merge maneuvers for connected and automated vehicles: A survey,","venue":null,"work_id":"3c0ee322-6c58-46fd-aa7d-720849c094be","year":2016},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.795130Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:7e8b445844ca4a47de85dfa57222d6eb7115c47f826dcc279ff3444cceb652f5","observation_id":"f1d1bac1-74e3-472a-90f0-556e791050d5","resolution":{"observed_at":"2026-08-15T19:25:06.924804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.908073Z","title":"A comprehensive review of the development of adaptive cruise control systems,","venue":null,"work_id":"8fcc4053-ff4a-43cf-8c29-5e01e353cde9","year":2010},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.798907Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:aab3ceaf062795e401c887e12e31b4edf9827d28f05f328c366fc2d585b7adf3","observation_id":"7e838601-1564-42a2-8c43-12da132203b3","resolution":{"observed_at":"2026-08-15T19:25:06.912113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.896057Z","title":"Application of microscopic pedestrian simulation model,","venue":null,"work_id":"9ad084c4-71dd-4de8-bcfc-efd0f4a16425","year":2006},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.803185Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:45530dfd9136f1d0a42173ff48b747d68af029248a685442c48788b31469c6c2","observation_id":"c74b6642-bfa4-4c4d-9bc2-6994e3f85526","resolution":{"observed_at":"2026-08-15T19:25:06.900334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.807377Z","title":"Layered costmaps for context-sensitive navigation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.807377Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:60f0f1ed21b054cb7c4f82eb870c4c97e3845ad5cab800f415125f65c3e2b142","observation_id":"7393ea60-bc97-4aad-9965-43c3e4c2a5bc","resolution":{"observed_at":"2026-08-15T19:25:06.807377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.811756Z","title":"Carla: An open urban driving simulator,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.811756Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:040915ba451fa011b712c60bce25d192ffd211f03446b47bcbe4f24e4417897a","observation_id":"e4c67fca-aeb3-490b-ae0f-edda9035bdc6","resolution":{"observed_at":"2026-08-15T19:25:06.811756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:25:06.815723Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:06.815723Z"},"links":{"citing_paper":"/paper/2506.16720"},"observation_digest":"sha256:d241a530e4b35b322bf4b8931e66be59299d0710c22774d47a97d5844595c621","observation_id":"a74d3d00-df2a-49c8-890d-c1e1fcb1e1d8","resolution":{"observed_at":"2026-08-15T19:25:06.815723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16720","last_updated":"2025-06-20T03:32:01Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T18:28:51.135744Z","submitted_at":"2025-06-20T03:32:01Z","title":"DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2506.16720."}