{"as_of":"2026-08-12T08:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:67c45c7176df941e15bb9820f0bc3a46f08e56dc8a3404c820b1af2d5486230b","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:35:18.236786Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:43:45.813958Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-04T12:16:13.904932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2507.05251","doi":"10.48550/arxiv.2507.05251","metadata_source":"pith","pith_arxiv_id":"2507.05251","snapshot_observed_at":"2026-08-04T12:16:13.904932Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","venue":"cs.RO","work_id":"b9558add-1b4a-48e5-878f-e879eda52ee7","year":2025},"citing_paper":{"arxiv_id":"2510.14479","last_updated":"2026-06-01T09:22:06Z","snapshot_observed_at":"2026-08-09T00:45:48.372979Z","submitted_at":"2025-10-16T09:23:48Z","title":"Optimality-Based Control Space Reduction for Infinite-Dimensional Control Spaces","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:45.813958Z"},"links":{"cited_paper":"/paper/2507.05251","citing_paper":"/paper/2510.14479"},"observation_digest":"sha256:f33dd46cc9943c0cafdcf9fa77e3e8dc026c33621d641df824e32f19b4f2ee2d","observation_id":"d8de6b98-7696-4ccd-8a98-ed089e04fca8","resolution":{"observed_at":"2026-08-04T09:49:30.139004Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05251","snapshot_observed_at":"2026-08-03T16:52:51.218277Z","title":"arXiv preprint arXiv:2507.05251","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.11944","last_updated":"2026-05-28T11:10:14Z","snapshot_observed_at":"2026-08-03T16:52:46.785804Z","submitted_at":"2025-12-12T14:01:24Z","title":"A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:52:51.218277Z"},"links":{"cited_paper":"/paper/2507.05251","citing_paper":"/paper/2512.11944"},"observation_digest":"sha256:0aa19810534826cdd58f9388f1b64f5c5d41e7abf281d0a5f2fc6a8d56d5dc69","observation_id":"a621fc51-a9c7-4e6e-87cf-ae048b3bd736","resolution":{"observed_at":"2026-08-03T16:52:51.218277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05251/citation-record","integrity":"/paper/2507.05251/integrity","json":"/paper/2507.05251/citation-record.json","paper":"/paper/2507.05251"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.897130Z","title":null,"venue":null,"work_id":"18b74a9c-880c-4982-bfa4-e0aff4bc54c4","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.442274Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:06ef6a9c62d5218e4285f95c30822281f98b12e4d4934c1901369ba0d38651bb","observation_id":"9fc4fd64-7de0-4799-a444-af4d8e4d4c89","resolution":{"observed_at":"2026-08-06T19:35:29.933684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.813824Z","title":"Common- road: Composable benchmarks for motion planning on roads","venue":null,"work_id":"c3e5b7ef-0e7c-484a-bfe0-19efb72cdc2c","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.521246Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3834f157ea8e764ec294337bc3e963efecbefd5445fe80dbf58a4626dd3078ec","observation_id":"c1900ad3-64b1-4f45-b219-1360e0c4918f","resolution":{"observed_at":"2026-08-06T19:35:29.853056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.673591Z","title":"Reinforced Cur- riculum Learning For Autonomous Driving In Carla","venue":null,"work_id":"ad901b5a-a180-4de2-bc8c-abdc811a8917","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.624485Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:01d46405ffc15babfabd1c181068f4699fe01c41382c26f54d24ed9cee9b8630","observation_id":"53adcf0d-b4fb-42a8-87df-0fe2174a49a2","resolution":{"observed_at":"2026-08-06T19:35:29.713976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.583903Z","title":"Traffic Signal Control Using Hybrid Action Space Deep Reinforcement Learning","venue":null,"work_id":"8ed11147-2e7d-418d-a2a8-4a39a8da78dd","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.699913Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:4d207ba57877a455e2c173abf59a408a186c08ed111b8f95e840a94b6dcfad6b","observation_id":"6fd755e0-a064-4e65-8124-3a4e5e157d0d","resolution":{"observed_at":"2026-08-06T19:35:29.617128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.491397Z","title":"OpenAI gym","venue":null,"work_id":"5930b664-a69f-4d58-83ca-84d826fee10a","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.806563Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:116bcf9807b4188c2f64ee58fb9e4fca53a1ec09fbf7065d2139b89973b26f68","observation_id":"334a5765-4fc9-4553-a2a7-9c035a6370c4","resolution":{"observed_at":"2026-08-06T19:35:29.532670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.386733Z","title":"GRI: General Reinforced Imitation and its Application to Vision-Based Autonomous Driving, May 2022","venue":null,"work_id":"180bdaf5-1a92-4a97-96ae-428ab279e451","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:13.870649Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:89e4e77e40e527a6050d996159eab49fb68a4631a0167e36ffd96f484c35c8c9","observation_id":"5fb24d38-05ae-4caf-a0c9-f090ef109464","resolution":{"observed_at":"2026-08-06T19:35:29.424861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.250703Z","title":"Learning to drive from a world on rails, October 2021","venue":null,"work_id":"8f670f25-a75b-4c5c-905f-fb4e3ad55031","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.005963Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:bf9571dd5ad0883319ea1f3647a098e00495bd4418ae9a187168894080837d7b","observation_id":"59736d64-fcef-449d-ac90-4d24f2688fcd","resolution":{"observed_at":"2026-08-06T19:35:29.335035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.177516Z","title":"Context- Aware Meta-RL With Two-Stage Constrained Adaptation for Urban Driving","venue":null,"work_id":"b2f5cff1-8eab-4714-862b-26037970c81e","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.136113Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:52c73a43a9bc00f4dab75af261e2d8511242e74edce94e74c72d26bfa73c3dd0","observation_id":"9dc4f863-806d-4c97-a51d-a7d5c47f4ab9","resolution":{"observed_at":"2026-08-06T19:35:29.206796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.105077Z","title":"Context - Enhanced Meta-Reinforcement Learning with Data-Reused Adaptation for Urban Autonomous Driving","venue":null,"work_id":"f052e048-1469-436c-ac1d-b879d8d91113","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.245983Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:e212c6438065e72c5064bc5e710b3a552240dc7a5c0dad07b5248b885af31f4a","observation_id":"689a04e5-44c6-44d0-88b8-22a0cf0e1cd5","resolution":{"observed_at":"2026-08-06T19:35:29.126503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:29.028679Z","title":"CARLA: An Open Urban Driving Simulator","venue":null,"work_id":"a18f2416-3c06-4d34-848c-5db0b92223c3","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.345319Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:6b17f91a5b136a3fdf1db6c4c4884a6e9e3d10ffe0fd1da016e86cec6874a3cb","observation_id":"ffa34a45-ba45-4ba1-8cfa-d3d4138f8b73","resolution":{"observed_at":"2026-08-06T19:35:29.055142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.944533Z","title":"Deep reinforcement learning in large discrete action spaces","venue":null,"work_id":"b430a0d4-2595-4b4d-a76b-6204cdf0da72","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.447711Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:e0c5e945afec1f54ee9a3bfbb68f45ded12550a699e46ea8e2cec256dbd1627c","observation_id":"149ca7bd-b8c3-428a-b9d4-de4889b9a991","resolution":{"observed_at":"2026-08-06T19:35:28.976461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.815546Z","title":"DQN-based Reinforcement Learning for Vehicle Control of Autonomous Vehicles Interacting With Pedestrians","venue":null,"work_id":"be0dc751-a12e-49e1-b58d-90fbfd2ade76","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.558039Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:d833c8e20c90a009b907c69c6b12c1f18c86ed15b03efc0411896ee5892dd479","observation_id":"99f276d1-200a-42cb-bd4a-05d3f44e7a3e","resolution":{"observed_at":"2026-08-06T19:35:28.890398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.712260Z","title":"Growing Action Spaces, June 2019","venue":null,"work_id":"2a29d0a4-fe0f-43df-b99b-74c5a8474795","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.637587Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b60d5816075cda69e3663d52d8098fd8f8b922aa1ae35fa59a614854f40c307e","observation_id":"663f4c56-2539-4fe0-8de0-1873ae08e5c4","resolution":{"observed_at":"2026-08-06T19:35:28.751579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1049/itr2.12593","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Intersection decision making for autonomous vehicles based on improved PPO algorithm","venue":"IET Intelligent Transport Systems","work_id":"6d969192-fa86-4dd0-8e06-c8caf433bb1c","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.747612Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:636c0e7033642ef40712073fd7015f017176428e44ccc37c9dfb3657482337f2","observation_id":"b46ce158-6fc0-4b5c-8213-a9785438fccd","resolution":{"observed_at":"2026-08-06T19:35:18.393221Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.576911Z","title":"Interactive fiction games: A colossal adventure","venue":null,"work_id":"91bb80bb-73d7-4f2b-98ec-78e622af1553","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.830034Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:a471bbdfcc9155e7ad3177030d618589b2c567283364d8eefbf4b91fb074f5f6","observation_id":"f2c2f208-0116-4f94-a753-37087525948f","resolution":{"observed_at":"2026-08-06T19:35:28.648965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.352285Z","title":"Le, and Hartwig Adam","venue":null,"work_id":"cd077b79-f6ac-4326-90db-c97fa5566935","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:14.903360Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:979f9f50deeb4295900bbdc411ca394cb0d208b664b748caa5b9409c79634ea3","observation_id":"99c252ac-a11f-464b-8646-41672b982707","resolution":{"observed_at":"2026-08-06T19:35:28.455633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:28.093074Z","title":"A closer look at invalid action masking in policy gradient algorithms","venue":null,"work_id":"b368a5a1-13ba-4cc1-aed6-43bf1cc8754f","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.018125Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:012dad4e54b5b79cd85bfc42c58998d5e189170cff0a3c501cafc5b132343a36","observation_id":"6c0e69ee-7d55-44c6-9f80-59b39fd7e660","resolution":{"observed_at":"2026-08-06T19:35:28.242679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.847437Z","title":"Safe Reinforcement Learning on Autonomous Vehicles","venue":null,"work_id":"6f4bbf84-1f70-4520-a7c5-28d2c502508c","year":2018},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.119280Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:779005e8f6540d56056b137b8cb787aa98cec7539936e4dacb199d06b20e77a1","observation_id":"5d538448-78ae-4dfb-9936-16531bead1d8","resolution":{"observed_at":"2026-08-06T19:35:27.960322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.523961Z","title":"Action Space Shaping in Deep Reinforcement Learning, May 2020","venue":null,"work_id":"b521f87b-88a5-4fde-b0f9-e64410cc4aea","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.250752Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:876e5f9a3a6fffe469ed299deaab1ee3e28e2d9c71f42c5058786901ff87055b","observation_id":"f3849438-59b6-42e1-83de-f94a1feca6b4","resolution":{"observed_at":"2026-08-06T19:35:27.674671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:27.265534Z","title":"ViZDoom: A doom-based AI research platform for visual reinforcement learning","venue":null,"work_id":"8a824546-4576-4139-991c-ecb1e192f842","year":2016},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.337773Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:976787f153d96a302e05957f8f7fc1502b124db2cc60205e336bbcd5a70d78b1","observation_id":"9bc8423a-2445-4464-863b-4e4244ce7cd7","resolution":{"observed_at":"2026-08-06T19:35:27.368120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.972561Z","title":"Learning to Drive in a Day","venue":null,"work_id":"e7cb9a83-b5b1-4af1-b956-bdcb6d58d2f6","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.409707Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:69c138be20a67f663d15519585075f1762cddc96470cc173a0e47f21595b3659","observation_id":"aea4bded-93c0-4b60-9660-0e0fa64d05bb","resolution":{"observed_at":"2026-08-06T19:35:27.092805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.637235Z","title":"Al Sallab, Senthil Yogamani, and Patrick P ´erez","venue":null,"work_id":"5140ed27-967e-4aa6-b853-412131d46cbc","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.491956Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:de7178d02cf04717683e87a888474d524818612be7a37c61f705b1f5db389ade","observation_id":"d0d9bdae-bd92-4acd-baae-0eaf97b79ac9","resolution":{"observed_at":"2026-08-06T19:35:26.809362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.396205Z","title":"The highD dataset: A drone dataset of naturalistic vehicle trajectories on german highways for validation of highly automated driving systems","venue":null,"work_id":"57ca870c-c940-4b6d-8e6b-7b258c0cdebb","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.558801Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ad49ed31a5a0644ad034f01745411aa44e7e98070a7044cec4ae32fc3dcaa788","observation_id":"f02a4db6-d690-4fc5-805c-da61787141c7","resolution":{"observed_at":"2026-08-06T19:35:26.510666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:26.173433Z","title":"Safe Rein- forcement Learning for Autonomous Lane Changing Using Set-Based Prediction","venue":null,"work_id":"ec5bbdd2-a805-4d98-9e12-58dd3774b230","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.630752Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:b68f1e4bbaad5cb17f38f74d1fcf429056fe18d12bea602f4d7a1f07978fa702","observation_id":"7ad0b9aa-ca5b-4d67-a791-5aa303a2d370","resolution":{"observed_at":"2026-08-06T19:35:26.278660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.916932Z","title":"HyAR: Addressing discrete- continuous action reinforcement learning via hybrid action representa- tion","venue":null,"work_id":"cac61b18-e541-475a-afa0-0f9aa53df9f4","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.710596Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ef7f239ac64088591853453034629b4c3d270f15abf75b255d149ed854014e01","observation_id":"db0289f5-b275-475d-988a-74b909036a0b","resolution":{"observed_at":"2026-08-06T19:35:26.052693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.599401Z","title":"Think2Drive: Efficient Reinforcement Learning by Thinking in Latent World Model for Quasi-Realistic Autonomous Driving (in CARLA-v2), July 2024","venue":null,"work_id":"1e07363d-ef07-4bad-aa25-d54281f856a3","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.814516Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:fca4ffb98492feaf30dd6cb368cf14251879700638738d05159c9232b59dd78e","observation_id":"65bd2261-1c5d-49b2-812d-c9aecfc4dd66","resolution":{"observed_at":"2026-08-06T19:35:25.758917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.347200Z","title":"MetaDrive: Composing diverse driving scenarios for generalizable reinforcement learning","venue":null,"work_id":"200a4c09-69b1-40e5-92db-bab781078237","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.886884Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:5fd16a3838e55ecb81a70f3cd14c877773117514a6b3af58c6ad08b9ebe6ecac","observation_id":"0ed34ddc-d396-4fef-b85a-93f64f023e9f","resolution":{"observed_at":"2026-08-06T19:35:25.455788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:25.064724Z","title":"Achieving sample and computational efficient reinforcement learning by action space reduction via grouping","venue":null,"work_id":"7dd0afa3-4b3d-431a-84eb-bb315898869e","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:15.982447Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:1a7d31c5bf13e5b8c5b9a206fb28c21651b6d0a9b7f804e4f7c5f81a6b1a49a6","observation_id":"375cd1d9-c71e-4195-94f0-78ee279c5b17","resolution":{"observed_at":"2026-08-06T19:35:25.197833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.845602Z","title":"Achieving Sample and Com- putational Efficient Reinforcement Learning by Action Space Reduction via Grouping, June 2023","venue":null,"work_id":"9acd188e-16c7-413b-b86c-d35cec18720c","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.075874Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:18aeb6462d011a92aaf5533e771f4a6d695abab6de20623fe88c0e739eb3128e","observation_id":"44c8e0b2-3c75-49ee-939e-c83a5dcee611","resolution":{"observed_at":"2026-08-06T19:35:24.949058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T19:35:16.155246Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.155246Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:99514d1d2a53bfe64541a6bae6297a60baadfa0fbfccb528ddc59c73750ec0c0","observation_id":"76a749f2-12ba-4d56-b0d2-8082b5e5640d","resolution":{"observed_at":"2026-08-06T19:35:16.155246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.547741Z","title":"Exact Reduction of Huge Action Spaces in General Reinforcement Learning, December 2020","venue":null,"work_id":"6f30a13e-892e-4dfb-8d5c-6a504de391b2","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.225499Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:cf3eb28e132293ddfee52686a427c79f8c4737d2b7b51cad733d528daa8ca0e6","observation_id":"9fc94ac8-d326-40f5-ac27-16311114e2e9","resolution":{"observed_at":"2026-08-06T19:35:24.700651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:24.231661Z","title":"Webotstm: Professional mobile robot simulation, 2004","venue":null,"work_id":"f15cbfda-5e87-4696-847c-125632946efc","year":2004},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.294312Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:a95c12a104826da9db1ece4ae3c515db256b8819ab28e8e97699315f273620b5","observation_id":"96c4f514-51c7-469d-b405-4c276e8df0fd","resolution":{"observed_at":"2026-08-06T19:35:24.360677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.908855Z","title":"Safe and Psychologically Pleas- ant Traffic Signal Control with Reinforcement Learning using Action Masking","venue":null,"work_id":"4d8c1bde-4421-4393-aaf2-d3a95b00be00","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.373175Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:09f9fa572908d479828e9eb5cb5bf4b8fcea2da9d839fc5b4a328ffd1532867b","observation_id":"f4fd03d3-6e6a-4865-89a8-306030c4c856","resolution":{"observed_at":"2026-08-06T19:35:24.075537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.652146Z","title":"Bergasa, Carlos G ´omez-Hu´elamo, Rodrigo Guti ´errez, and Alejandro D ´ıaz-D´ıaz","venue":null,"work_id":"67880ea1-f5ef-4a4f-9f65-1531444cb799","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.483722Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ba65d24c59a667b5fe9f931098fbb249e9c611a206a378c55979af75bfc457ac","observation_id":"212c8caa-d03d-4b59-8905-45d12334e313","resolution":{"observed_at":"2026-08-06T19:35:23.787443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.319709Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":"11694826-1320-411a-89f5-1fa0bc67424f","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.568058Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:945b642cb87504e01f95399ba76a9339d59b88c0e96d75afcba6fd09466f9ac0","observation_id":"b826fcc2-c788-4bb1-a2f6-4dcdbf7e4b79","resolution":{"observed_at":"2026-08-06T19:35:23.493672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:23.003794Z","title":"Fuzzy Action-Masked Reinforcement Learning Behav- ior Planning for Highly Automated Driving","venue":null,"work_id":"1e6fac6e-8c11-4b18-974a-2e3b4f4a629b","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.638214Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:bf7112b879aefcf6aaeafa5aebc0bf17b552f84ddc0a9eb00fee70222fe18f06","observation_id":"0d295925-6ef8-4bf6-93d3-34659de18bdb","resolution":{"observed_at":"2026-08-06T19:35:23.149061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.707136Z","title":"Proximal Policy Optimization Algorithms, August 2017","venue":null,"work_id":"d60ce162-8346-4aab-90ea-101fa7d4c1ef","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.711748Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:1e5efcad62f43ec729b281d4a9d5eaed024bd3b93022df4f04a1395f7c58e461","observation_id":"3a5418d4-9ca9-4bfd-bfdd-9be8be64216a","resolution":{"observed_at":"2026-08-06T19:35:22.853825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.436309Z","title":"Autonomous driving in CARLA using deep reinforcement learning","venue":null,"work_id":"f3123441-9081-471a-b07e-c21a06ac1b51","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.813469Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3ab89c2671f64091748f29561f24cf287fdf25d03d4b0e19548028a4c133f2d3","observation_id":"18e281a0-e802-4c1f-b258-650a4140d0d9","resolution":{"observed_at":"2026-08-06T19:35:22.583252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.896785Z","title":"Excluding the irrelevant: Focusing reinforcement learning through continuous action masking","venue":null,"work_id":"76a83311-17aa-4837-9dde-4317fb48382d","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.978913Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:1dd40872ed2175badcd93f637f1888bd2d82ea396c28c870c26506b606bb7c15","observation_id":"3b577942-8ade-404e-b1f1-21321b7076b9","resolution":{"observed_at":"2026-08-06T19:35:22.006831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.680871Z","title":"Dynamic Action Space Handling Method for Reinforcement Learning Models","venue":null,"work_id":"188240d7-41c9-4130-86ed-9c5ffec06099","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.062317Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:fcff61acaa4946f465f804ce1f7b14f112c7c225b1d2cbdfa87354a0b0bfbc31","observation_id":"d0b5efd1-7fbd-4119-a93e-83ce832133f4","resolution":{"observed_at":"2026-08-06T19:35:21.780596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.08946","last_updated":"2019-01-25T04:01:24Z","snapshot_observed_at":"2026-08-10T05:50:34.316767Z","submitted_at":"2017-11-24T12:45:30Z","title":"Action Branching Architectures for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1711.08946","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.08946","snapshot_observed_at":"2026-08-06T19:35:18.493475Z","title":"Action Branching Architectures for Deep Reinforcement Learning","venue":"cs.LG","work_id":"0d0b6731-c5a0-401d-bdf9-ec48cf632e8c","year":2017},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.156537Z"},"links":{"cited_paper":"/paper/1711.08946","citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3f0ef9cf5c17c7b81f5854acff3b2171834e5338981e54f0c04f8bcce6ba7951","observation_id":"1973575f-24fe-4150-a094-6280a79cb4f8","resolution":{"observed_at":"2026-08-06T19:35:18.555669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.443699Z","title":"Action Branch- ing Architectures for Deep Reinforcement Learning, January 2019","venue":null,"work_id":"1f45ba4d-5c86-4594-93b0-d64f63ea30b1","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.231928Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ba844e274ee78f58e40794db14d07ffd6678dcd6baabd8e6cd4ec5fd9b0dd0a9","observation_id":"5c216267-9c44-40b9-8454-5e19527aa9d5","resolution":{"observed_at":"2026-08-06T19:35:21.564230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:21.205948Z","title":"End-to-End Model-Free Reinforcement Learning for Urban Driving using Implicit Affordances, March 2020","venue":null,"work_id":"f862b565-f5d7-400f-a95b-ea104495643d","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.331281Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:5787268d8d05564f9ece995dd0e09e4166eedea11fca66f8c900216d216c47d0","observation_id":"97820b29-a8d0-4ed4-b318-1590455f929f","resolution":{"observed_at":"2026-08-06T19:35:21.309590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.945953Z","title":"Deep Reinforcement Learning With Action Masking for Differential-Drive Robot Navigation Using Low-Cost Sen- sors","venue":null,"work_id":"d4ac89e7-7bdc-46dd-819e-7b2f25d7810e","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.403180Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3c6a3d1e093a687d2658cd69170e1fff916d94fa94fcdc408e5c1afae64e2ed9","observation_id":"319b9b1f-28f5-4a08-b871-066a79d248e5","resolution":{"observed_at":"2026-08-06T19:35:21.080173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.693294Z","title":"Pure-past action masking","venue":null,"work_id":"d91f0805-2722-4052-a87d-592a2e93d78d","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.482379Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:3538c5988ad22e2c9c01737cf9b7b910db0a86e977f4f0fcf36a2103569534f4","observation_id":"0ac7ed44-e6cb-42ab-9355-a187a696e8a4","resolution":{"observed_at":"2026-08-06T19:35:20.822863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.445313Z","title":"StarCraft II: A new challenge for reinforcement learning","venue":null,"work_id":"89e95134-2571-47c3-b6e1-3fb0251b051a","year":null},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.585693Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:c72eb15d2b987b47003381366d17193b70735b69bb69c2574be25351ab09d8d6","observation_id":"f2f6cb88-32b9-4952-b86a-af956dc6f340","resolution":{"observed_at":"2026-08-06T19:35:20.567637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:20.224744Z","title":"A Versatile and Efficient Reinforcement Learning Framework for Autonomous Driving, March 2022","venue":null,"work_id":"965c3ddc-2249-4827-9fd2-e34f2e27fe42","year":2022},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.682736Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:0c0e2eaa14dead4c4b4067258447cc29829feb997722e6682f5ac95c5a314ea5","observation_id":"0263943c-b9b9-4d00-8401-a96d94806213","resolution":{"observed_at":"2026-08-06T19:35:20.331689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.943949Z","title":"Continuous control for automated lane change behavior based on deep deterministic policy gradient algorithm","venue":null,"work_id":"afe1bf03-3e25-4ca8-be15-d5516c459d13","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.752763Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ac0a8da4cda94de7f3131c24565ac161938c6cd34b37959e08b3a83b8c5b4595","observation_id":"6ab01e6b-4ba2-4ad5-a88a-bf3d78533dc9","resolution":{"observed_at":"2026-08-06T19:35:20.083635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.652080Z","title":"Learning State-Specific Action Masks for Reinforcement Learning","venue":null,"work_id":"f704bd23-b258-45cc-8788-0091e45ae38b","year":2024},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.825011Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:69b71023be4886f182237b5bef115ff5692a94048df55dfd54c14f6af5a242dc","observation_id":"2ee4d27e-e7ac-4887-810c-3d69c2399e21","resolution":{"observed_at":"2026-08-06T19:35:19.804011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.423507Z","title":"Reinforce- ment Learning-based Autonomous Parking with Expert Demonstrations","venue":null,"work_id":"d3cee417-f01e-46e2-9efe-c80b77b3f497","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.887216Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:e14bedc48c23e091ae92075a17602a8520101dfcc31611db0317ef6f38e36b07","observation_id":"5c3fc09b-326a-459c-9cd5-12c5911dc05f","resolution":{"observed_at":"2026-08-06T19:35:19.510879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:19.191509Z","title":"Fuzzy sets, fuzzy logic, and fuzzy systems: selected papers , volume 6","venue":null,"work_id":"06ab73d9-39bb-4122-aafa-33322e57ce0d","year":1996},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:17.966481Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:1ebf539e4b04f1990d578d9477a758f13e20902b1f2025e4bea3e27d9dea4025","observation_id":"145f4dd3-be69-4947-b553-e384636a30e2","resolution":{"observed_at":"2026-08-06T19:35:19.297539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.984159Z","title":"Mankowitz, and Shie Mannor","venue":null,"work_id":"a7c2ce19-bf13-441a-aed5-752a914967c3","year":2019},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.034084Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:0964d81c3b4448a1af4c42a1025a5bac80029b7f1be4fc086f8e002c15df1452","observation_id":"5ed83298-c693-4d05-a919-43bcf6c19a7f","resolution":{"observed_at":"2026-08-06T19:35:19.082395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.856983Z","title":"Lexicographic Actor-Critic Deep Reinforcement Learning for Urban Autonomous Driving","venue":null,"work_id":"4984d7f9-0543-4965-952d-0cf2f482b644","year":2023},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.084907Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:795f24580e8eae368224828a0b1a40ab662e7d69fe46e71883ea116305cf43d6","observation_id":"d0dde9e4-07c7-468c-a605-1d29f20f1d30","resolution":{"observed_at":"2026-08-06T19:35:18.904729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.766384Z","title":"End-to-End Urban Driving by Imitating a Reinforcement Learning Coach, October 2021","venue":null,"work_id":"02797592-5a86-4c23-a5c3-4d4d38d51e29","year":2021},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.161447Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:02b91a8c128a84c44dd1ab85dad846125daa01e11ba8c0edd76d18f6dcfc5874","observation_id":"e7f801c5-5545-4e84-b6a2-31dc90b26e3c","resolution":{"observed_at":"2026-08-06T19:35:18.812416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:18.641816Z","title":"SMARTS: An open-source scalable multi-agent RL training school for autonomous driving","venue":null,"work_id":"ba62e10d-ccde-488a-9bf8-faffad6b9c13","year":2020},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:18.236786Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:9d2535969e1932de1812d0cc93b0ef1b755f23651e62403e2fd0423eb4e95fb8","observation_id":"568eaff2-4f33-4dd9-95dd-db46b4859fdc","resolution":{"observed_at":"2026-08-06T19:35:18.698875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:35:22.155951Z","title":null,"venue":null,"work_id":"662ab074-2244-48ac-92d4-15a229cbd67b","year":2025},"citing_paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:35:16.905871Z"},"links":{"citing_paper":"/paper/2507.05251"},"observation_digest":"sha256:ef030dc5c77aa112cec68aafd9ff5b076b85bcb497222ac826c6ee0d57ab636d","observation_id":"4b70ed98-1cab-4701-aa5d-855a8f17a524","resolution":{"observed_at":"2026-08-06T19:35:22.298894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05251","last_updated":"2025-07-07T17:58:08Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T09:21:43.346002Z","submitted_at":"2025-07-07T17:58:08Z","title":"Action Space Reduction Strategies for Reinforcement Learning in Autonomous Driving"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":51},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 2 inbound Pith citation observations for arXiv:2507.05251."}