{"as_of":"2026-08-22T04:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4951d0ad6e9107277595cd340d60c4a2c86231575f5aeb5851a4d078744e2b4","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:49:14.797853Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16336/citation-record","integrity":"/paper/2506.16336/integrity","json":"/paper/2506.16336/citation-record.json","paper":"/paper/2506.16336"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.13144","last_updated":"2024-09-20T01:17:54Z","snapshot_observed_at":"2026-08-19T08:36:07.211859Z","submitted_at":"2024-09-20T01:17:54Z","title":"Autonomous Driving at Unsignalized Intersections: A Review of Decision-Making Challenges and Reinforcement Learning-Based Solutions","version":1},"cited_work":{"arxiv_id":"2409.13144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.13144","snapshot_observed_at":"2026-08-06T23:49:16.693307Z","title":"Autonomous Driving at Unsignalized Intersections: A Review of Decision-Making Challenges and Reinforcement Learning-Based Solutions","venue":"cs.RO","work_id":"1adff50c-c8fb-4044-89ce-8e7b7c592847","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:09.979709Z"},"links":{"cited_paper":"/paper/2409.13144","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b7dfa6c8128a7f888a1812aa4c587816ecb5c213caa14e58ab72e9379d8f0698","observation_id":"117b6a38-8987-42aa-815d-6ed68ac816d6","resolution":{"observed_at":"2026-08-06T23:49:16.855488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.0084","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:16.452324Z","title":"Enhanced intelligent driver model to access the impact of driving strategies on traffic capacity,","venue":null,"work_id":"57e6ec41-6625-4510-9da2-6db23ed9f56a","year":1928},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.045389Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:260d7445dbd4cdf8a9f1fd84a3f440b516cd569e2c4d53359cb3e5a6fe85a442","observation_id":"0ee6d5c9-79b8-4efb-9c2a-ac0ea1a8ea53","resolution":{"observed_at":"2026-08-06T23:49:16.567981Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.387665Z","title":"Extended safety descriptor measurements for relative safety assessment in mixed road traffic,","venue":null,"work_id":"d0775f9e-f07c-47b7-b44b-5b1524246473","year":2012},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.208393Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a54232ab805c9c4a1557114e009779355e2bbb75132e4836265fc7d9bbf1aae8","observation_id":"ab3dbb70-193c-45c9-bf85-6051c9ce7b9f","resolution":{"observed_at":"2026-08-06T23:49:19.466504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:10.359278Z","title":"Analysis of optimal velocity model with explicit delay,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.359278Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:1ad5f7caf095e2102a0871481b3bcd187a81648030b9611d4df5e1505887ee7d","observation_id":"26bb3be2-7e4b-497b-84b4-8774b67b1c5e","resolution":{"observed_at":"2026-08-06T23:49:10.359278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.272343Z","title":"End to end learning for self-driving cars,","venue":null,"work_id":"6abb068e-2248-4879-a969-91a8456cd751","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.458971Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:609e169d7540127d59f0ab550c4bd410521a5ba05746460bd40c580faadb58e4","observation_id":"f4ed6449-325b-4c5a-9c88-29689429fb15","resolution":{"observed_at":"2026-08-06T23:49:19.321928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03079","last_updated":"2018-12-07T16:04:00Z","snapshot_observed_at":"2026-08-16T02:14:42.637413Z","submitted_at":"2018-12-07T16:04:00Z","title":"ChauffeurNet: Learning to Drive by Imitating the Best and Synthesizing the Worst","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03079","snapshot_observed_at":"2026-08-06T23:49:10.703645Z","title":"Chauffeurnet: Learning to drive by imitating the best and synthesizing the worst,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.703645Z"},"links":{"cited_paper":"/paper/1812.03079","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a065cca9c7126ff6de949cfde4f5c77163579997cb73486738584c207b2a2b90","observation_id":"5f3ccb8d-1c36-4a81-a3fb-29b51c65009f","resolution":{"observed_at":"2026-08-06T23:49:10.703645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.01196","last_updated":"2018-02-27T03:09:02Z","snapshot_observed_at":"2026-08-14T21:03:13.612731Z","submitted_at":"2017-05-02T22:57:36Z","title":"Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1705.01196","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.01196","snapshot_observed_at":"2026-08-06T23:49:16.151878Z","title":"Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning","venue":"cs.AI","work_id":"061e442d-def4-4c11-aabc-590e7d05dbc5","year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.825859Z"},"links":{"cited_paper":"/paper/1705.01196","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:85633adf33aaa4927469fd0b96946739ff7ae0ca54d61a04aaa71d83b846ab1e","observation_id":"df52118b-0f50-4af1-b9f2-511523201f97","resolution":{"observed_at":"2026-08-06T23:49:16.254374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10469","last_updated":"2018-10-24T16:06:33Z","snapshot_observed_at":"2026-08-14T18:09:53.952711Z","submitted_at":"2018-10-24T16:06:33Z","title":"Learning Negotiating Behavior Between Cars in Intersections using Deep Q-Learning","version":1},"cited_work":{"arxiv_id":"1810.10469","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.10469","snapshot_observed_at":"2026-08-06T23:49:15.938586Z","title":"Learning Negotiating Behavior Between Cars in Intersections using Deep Q-Learning","venue":"cs.LG","work_id":"0e495571-61b7-4eb3-8103-9b6e5951135d","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.964587Z"},"links":{"cited_paper":"/paper/1810.10469","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:05fee79cd7cafc197a338635c8e95ff79873665dfce11d7a39730198fbf17243","observation_id":"41825fd5-c11b-4f55-b155-c0c9ee38ffed","resolution":{"observed_at":"2026-08-06T23:49:16.032798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12250","last_updated":"2019-11-27T16:14:15Z","snapshot_observed_at":"2026-08-14T00:08:39.122835Z","submitted_at":"2019-11-27T16:14:15Z","title":"Social Attention for Autonomous Decision-Making in Dense Traffic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12250","snapshot_observed_at":"2026-08-06T23:49:11.091194Z","title":"Social attention for autonomous decision-making in dense traffic,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.091194Z"},"links":{"cited_paper":"/paper/1911.12250","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:f6324126de1bf2f3c4e49d3b93286f35b115704717948b2c0d1f2f70a46151dc","observation_id":"24ae827a-277c-43c0-9b83-ff267a4b87f0","resolution":{"observed_at":"2026-08-06T23:49:11.091194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.119241Z","title":"A multi-task reinforcement learning approach for navigating unsignalized intersections,","venue":null,"work_id":"67a5f73a-7301-440b-b4ea-d3e0d747129a","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.215996Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:981582d276442deabea0846129bb9ab36041f4ced61e91b465511f7b39a3cf6c","observation_id":"634a9400-a604-4c21-ab8e-e6b1a4d0976c","resolution":{"observed_at":"2026-08-06T23:49:19.189396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.843876Z","title":"Pomdp and hierarchical options mdp with continuous actions for autonomous driving at intersections,","venue":null,"work_id":"26c21d8c-b9bc-4da0-ab76-d63c956b370f","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.385053Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:aa8a4be761f5e91622dc10a565cc0ca960da4961a78283f4e741ff471e4fb3df","observation_id":"cf90fdee-691c-4a1c-9e0f-19d1e152bec2","resolution":{"observed_at":"2026-08-06T23:49:18.944152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04697","last_updated":"2020-11-09T19:23:26Z","snapshot_observed_at":"2026-08-17T18:25:43.516567Z","submitted_at":"2020-11-09T19:23:26Z","title":"Behavior Planning at Urban Intersections through Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.04697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.04697","snapshot_observed_at":"2026-08-06T23:49:15.682689Z","title":"Behavior Planning at Urban Intersections through Hierarchical Reinforcement Learning","venue":"cs.RO","work_id":"45caf8d1-94db-494c-ae9d-31a22f7a2a90","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.506469Z"},"links":{"cited_paper":"/paper/2011.04697","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:dacca01c7eba9ed12aaa4e974c33fc1c031b8572f8b3e88632accee086aa9822","observation_id":"0ba67e87-a373-4f1b-b026-cfd37ff24656","resolution":{"observed_at":"2026-08-06T23:49:15.806518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:11.624122Z","title":"Action and trajectory planning for urban autonomous driving with hierarchical reinforcement learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.624122Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:f13cbfe2c1ee5301d56e63c4ec06023e864ebf91dc817c3016d951618ae2a41a","observation_id":"bbac736c-efe4-496e-b0c8-7f9c88380e02","resolution":{"observed_at":"2026-08-06T23:49:11.624122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.574000Z","title":"Safe reinforcement learning on autonomous vehicles,","venue":null,"work_id":"287238ee-b626-4b35-83a3-7f2ffb79481e","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.854782Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:bde2bd6a7318a8a2797655654a2c85a57966481946eb1dfefbfed23e9ce85f30","observation_id":"6bac7e8b-6c20-4214-9cb5-17bd944f04bb","resolution":{"observed_at":"2026-08-06T23:49:18.721818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06783","last_updated":"2022-03-01T03:53:04Z","snapshot_observed_at":"2026-08-17T14:08:53.454344Z","submitted_at":"2021-09-14T15:54:35Z","title":"Learning to Navigate Intersections with Unsupervised Driver Trait Inference","version":2},"cited_work":{"arxiv_id":"2109.06783","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.06783","snapshot_observed_at":"2026-08-06T23:49:15.413067Z","title":"Learning to Navigate Intersections with Unsupervised Driver Trait Inference","venue":"cs.RO","work_id":"1860b222-afab-4bbc-a371-f8845c3e0e10","year":2021},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.986404Z"},"links":{"cited_paper":"/paper/2109.06783","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:2159fb04dc7f45435e1569f2cc8ff96f858a6f2a1ec1296013b4d01244f79b78","observation_id":"eb576bdf-531c-4c0f-b9fd-d411cf778a2b","resolution":{"observed_at":"2026-08-06T23:49:15.505005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.292496Z","title":"Human-like decision making at unsignalized intersections using social value ori- entation,","venue":null,"work_id":"e582743a-5d6a-4da8-8ea5-f5da32177283","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.093783Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:704913af2b82db66d508295813814629dd163b48faf6df8393268fd7c9e9efb9","observation_id":"6bc65589-4427-468b-a705-8815a3094f37","resolution":{"observed_at":"2026-08-06T23:49:18.415770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.001834Z","title":"Interactive autonomous navigation with internal state inference and interactivity estimation,","venue":null,"work_id":"97f10ee4-9ab4-496a-a218-0974a33cb568","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.243166Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:0faeee03076fbb194e691ba9a8798d228e8734a36015098f399a82df002278b6","observation_id":"91f99a7a-e874-4936-9487-37a3581c1db0","resolution":{"observed_at":"2026-08-06T23:49:18.127625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.759288Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning,","venue":null,"work_id":"8aa900d0-728f-4b7b-8384-dc8b3d0e9fdc","year":1999},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.391343Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:526347e7ed65e978a4448e46f17a1a7938adeb1b7d87cfe1ab537cfd74d13fe3","observation_id":"d8417676-b812-4f2e-ab62-313a174f5141","resolution":{"observed_at":"2026-08-06T23:49:17.849826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:12.500305Z","title":"Feudal reinforcement learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.500305Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:32c6df9f74bf5a99cc2ca9f982cf17fdaa302ad835c5a8cf74c3ac18f110a578","observation_id":"bcaaddc6-da14-4cf4-9159-1a266599e13a","resolution":{"observed_at":"2026-08-06T23:49:12.500305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06057","last_updated":"2016-05-31T14:45:58Z","snapshot_observed_at":"2026-08-14T22:00:48.745788Z","submitted_at":"2016-04-20T18:47:48Z","title":"Hierarchical Deep Reinforcement Learning: Integrating Temporal Abstraction and Intrinsic Motivation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.06057","snapshot_observed_at":"2026-08-06T23:49:12.644637Z","title":"Hierarchical deep reinforcement learning: Integrating temporal abstraction and intrinsic motivation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.644637Z"},"links":{"cited_paper":"/paper/1604.06057","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:8d14e2f45778de2ae832e3da2ea5ee2c79b0024afc659091aca70ce477e6069a","observation_id":"b1b5c3f8-d11b-48c9-84c0-67c1bff50f6f","resolution":{"observed_at":"2026-08-06T23:49:12.644637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08296","last_updated":"2018-10-05T12:39:37Z","snapshot_observed_at":"2026-08-16T02:50:11.309391Z","submitted_at":"2018-05-21T21:33:44Z","title":"Data-Efficient Hierarchical Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08296","snapshot_observed_at":"2026-08-06T23:49:12.786912Z","title":"Data-efficient hierarchical reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.786912Z"},"links":{"cited_paper":"/paper/1805.08296","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a378700653b236a544992363090fb4fd1d1220614be530e95f40c06b63b9e24e","observation_id":"1a17800a-5966-4d80-8d93-b589c280009d","resolution":{"observed_at":"2026-08-06T23:49:12.786912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-08-17T01:47:25.235810Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-06T23:49:12.947806Z","title":"Learning multi-level hierarchies with hindsight,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.947806Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:d976f44d7470ad82b175acd4dff1d311b7d61b0d0f7585b9539974e58fcd7051","observation_id":"77b7febc-4a27-4da2-bba3-9c65c30fe74c","resolution":{"observed_at":"2026-08-06T23:49:12.947806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.543931Z","title":"Multipath: Multiple probabilistic anchor trajectory hypotheses for behavior prediction,","venue":null,"work_id":"774766a5-4eca-422f-aee6-b0a50913926c","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.093012Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:c0d330efaa5d7aff27bd1a5025f0c2f4f2ec2c45df91244c261662ecb03c60f7","observation_id":"a06babb2-978f-4762-b0cd-9c6a32bb8c83","resolution":{"observed_at":"2026-08-06T23:49:17.642287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13732","last_updated":"2020-07-27T17:59:49Z","snapshot_observed_at":"2026-08-15T03:05:20.167497Z","submitted_at":"2020-07-27T17:59:49Z","title":"Learning Lane Graph Representations for Motion Forecasting","version":1},"cited_work":{"arxiv_id":"2007.13732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13732","snapshot_observed_at":"2026-08-06T23:49:15.054435Z","title":"Learning Lane Graph Representations for Motion Forecasting","venue":"cs.CV","work_id":"fea08cde-3aad-4615-b747-8af059cbd847","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.400237Z"},"links":{"cited_paper":"/paper/2007.13732","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b3fd4710a622d17401137d37be84ea4b3c16e56b920434b998d1bf47c6390910","observation_id":"6461e5fb-e054-4672-83cf-106621710998","resolution":{"observed_at":"2026-08-06T23:49:15.123765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08294","last_updated":"2020-08-21T07:33:10Z","snapshot_observed_at":"2026-08-21T09:07:34.294118Z","submitted_at":"2020-08-19T06:52:46Z","title":"TNT: Target-driveN Trajectory Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08294","snapshot_observed_at":"2026-08-06T23:49:13.523673Z","title":"Tnt: Target-driven trajectory prediction,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.523673Z"},"links":{"cited_paper":"/paper/2008.08294","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:7f6c3fa077fff190392a34c79f92b831df5b3ebaf6c4ac91f5df7c324ded1623","observation_id":"42429821-ae29-4de1-b089-6cf453b50753","resolution":{"observed_at":"2026-08-06T23:49:13.523673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:13.652077Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.652077Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:bbb217226e5afc53f359548b5b5e043d2071f9673013042073dfb36cb5e3c015","observation_id":"c66819fc-126f-4661-a848-982f4ad85d6f","resolution":{"observed_at":"2026-08-06T23:49:13.652077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03939","last_updated":"2023-02-08T08:32:16Z","snapshot_observed_at":"2026-08-17T11:10:59.190623Z","submitted_at":"2023-02-08T08:32:16Z","title":"Learning Interaction-aware Motion Prediction Model for Decision-making in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03939","snapshot_observed_at":"2026-08-06T23:49:13.760119Z","title":"Learning interaction- aware motion prediction model for decision-making in autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.760119Z"},"links":{"cited_paper":"/paper/2302.03939","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a70c1a7760a55fce9077dd6e4f3911160c91a4e73269711c475fb002d0131711","observation_id":"45fc5354-722d-43df-b207-f9136d67e99a","resolution":{"observed_at":"2026-08-06T23:49:13.760119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08417","last_updated":"2022-03-04T20:25:25Z","snapshot_observed_at":"2026-08-18T06:43:45.571895Z","submitted_at":"2021-06-15T20:20:44Z","title":"Scene Transformer: A unified architecture for predicting multiple agent trajectories","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08417","snapshot_observed_at":"2026-08-06T23:49:13.842331Z","title":"Scene transformer: A unified architecture for predicting multiple agent trajectories,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.842331Z"},"links":{"cited_paper":"/paper/2106.08417","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:38b34d5e80836c7775452ca150f792c3e8521388930bc9bef951f63031796c51","observation_id":"a999beb6-da79-46da-aaed-6ccd82a66ce4","resolution":{"observed_at":"2026-08-06T23:49:13.842331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04259","last_updated":"2020-05-08T19:07:03Z","snapshot_observed_at":"2026-08-13T21:05:21.964832Z","submitted_at":"2020-05-08T19:07:03Z","title":"VectorNet: Encoding HD Maps and Agent Dynamics from Vectorized Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.04259","snapshot_observed_at":"2026-08-06T23:49:13.943431Z","title":"Vectornet: Encoding HD maps and agent dynamics from vectorized representation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.943431Z"},"links":{"cited_paper":"/paper/2005.04259","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a927d7f6d7928a6bab429b37b78288aeb9410264922ac64e143da1285bf5bba7","observation_id":"b785a379-6c96-4f74-bb76-b26ffe255d2d","resolution":{"observed_at":"2026-08-06T23:49:13.943431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-08-19T04:42:40.974785Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-06T23:49:14.075473Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.075473Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:ee410d7cb3221dcee95e93778c58d7c7e025a76c33cfbd2ff606ba4745b15dd7","observation_id":"e6714b33-faaf-4814-917b-6be7996d76dd","resolution":{"observed_at":"2026-08-06T23:49:14.075473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.257944Z","title":"Separating axis theorem for oriented bounding boxes,","venue":null,"work_id":"de589eb2-4c9b-4632-846b-f76d156f86d9","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.202926Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:4c459dd36c00e8252b173bd5192be76742ebcf53ae48e966497f60cd75207460","observation_id":"dbe86f36-d6bf-4406-b8f7-077166cb340c","resolution":{"observed_at":"2026-08-06T23:49:17.396641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:49:14.419292Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.419292Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a5f2045a8b9c2a38a2f2669417353422eb119acb1bfc970a8392536115859f69","observation_id":"1a012cb7-39e4-4159-b9e1-ff95033a6cce","resolution":{"observed_at":"2026-08-06T23:49:14.419292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09776","last_updated":"2020-11-01T01:32:36Z","snapshot_observed_at":"2026-08-16T19:12:19.861633Z","submitted_at":"2020-10-19T18:26:10Z","title":"SMARTS: Scalable Multi-Agent Reinforcement Learning Training School for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09776","snapshot_observed_at":"2026-08-06T23:49:14.539948Z","title":"Smarts: Scalable multi-agent reinforcement learning training school for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.539948Z"},"links":{"cited_paper":"/paper/2010.09776","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:162ca7b029585008ace423783fcba926e250a1cf9430cda9b8722fc88e55d7bb","observation_id":"21ce2981-ed5c-403d-a2ca-899d11809ae8","resolution":{"observed_at":"2026-08-06T23:49:14.539948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T23:49:14.675888Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.675888Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:cbee04e73e5eb1b263273a1469df481f688544056bf53d89293d1b32419d8584","observation_id":"14840db5-cc5f-4874-bc3a-3300ae42800d","resolution":{"observed_at":"2026-08-06T23:49:14.675888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-20T10:26:26.238559Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-06T23:49:14.797853Z","title":"Soft actor-critic for discrete action settings,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.797853Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a27d0032a6502151fd05ed928213aba9623ce02278975b555a73a252dd004e12","observation_id":"7b6c6c6b-ad19-4b2e-8a59-d6bf083e2595","resolution":{"observed_at":"2026-08-06T23:49:14.797853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:16.999238Z","title":"Available: https://api.semanticscholar.org/CorpusID: 125587700","venue":null,"work_id":"188ca486-3e25-4d68-b105-7397f214f945","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.338878Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:3f2e0b49a1002c6f1e848c59e8598ba01568d7b5e5047a73a3130b886b50700c","observation_id":"8a9c4364-e1e3-4d73-9c04-347d07237822","resolution":{"observed_at":"2026-08-06T23:49:17.124427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-06T23:49:10.555549Z","title":"Available: https://arxiv.org/abs/1604.07316","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.555549Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:e52686cc2c20f5b244af11af76752585ee47f2ed4ccf7c91c2e5b6bd1261990d","observation_id":"4b2a6ee0-ded9-4b99-b15c-865d88d30efe","resolution":{"observed_at":"2026-08-06T23:49:10.555549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05449","last_updated":"2019-10-12T00:34:37Z","snapshot_observed_at":"2026-08-10T19:51:16.852667Z","submitted_at":"2019-10-12T00:34:37Z","title":"MultiPath: Multiple Probabilistic Anchor Trajectory Hypotheses for Behavior Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05449","snapshot_observed_at":"2026-08-06T23:49:13.253143Z","title":"Available: https://arxiv.org/abs/1910.05449","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.253143Z"},"links":{"cited_paper":"/paper/1910.05449","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:150ddf488552f50b48e2600072bf19e7094333a1f2dfbf5585c4243e82527f47","observation_id":"09da6045-488f-4dcb-ab9f-b449363a2107","resolution":{"observed_at":"2026-08-06T23:49:13.253143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15968","last_updated":"2023-06-28T07:11:02Z","snapshot_observed_at":"2026-08-16T15:20:31.793766Z","submitted_at":"2023-06-28T07:11:02Z","title":"Action and Trajectory Planning for Urban Autonomous Driving with Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15968","snapshot_observed_at":"2026-08-06T23:49:11.735202Z","title":"Available: https://arxiv.org/abs/2306.15968","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.735202Z"},"links":{"cited_paper":"/paper/2306.15968","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a60433d61c1d971ab30ec3182487aeb765b035f3983e2ded19126b61dbecc780","observation_id":"e0ee5f6a-6b20-4728-b96b-b6eb5f78f3c2","resolution":{"observed_at":"2026-08-06T23:49:11.735202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T17:59:48.040630Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":7,"verified_fuzzy":11},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2506.16336."}