{"as_of":"2026-08-14T19:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd5ac7657c7ae708c1d079b6f66f40701ed1f0ef9cd87ec706b70a058f320a46","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:13:45.072007Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15793/citation-record","integrity":"/paper/2505.15793/integrity","json":"/paper/2505.15793/citation-record.json","paper":"/paper/2505.15793"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:51.140424Z","title":"Reinforcement learning algorithms: A brief survey","venue":null,"work_id":"0c27afdd-4fd6-4a2d-9e08-cc7ad63691dd","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.007767Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:92a5712722dc8d6a5126fadf5ab60c6be7b23da142bc1f5aa3854620317cafec","observation_id":"ff2bf7b7-d52d-45aa-9f95-9e1c3d040280","resolution":{"observed_at":"2026-08-07T15:13:51.245923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:38.089874Z","title":"Deep reinforcement learning: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.089874Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:c555d8df1deb4f1d698ca9f2c29d77862ccdf0c62eebaf3486e51af1c017a6bd","observation_id":"ee4e5cd9-eb1f-478a-a4fa-e22e84b9b71e","resolution":{"observed_at":"2026-08-07T15:13:38.089874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-13T22:50:56.824374Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-07T15:13:38.190951Z","title":"A review of safe reinforcement learning: Methods, theory and applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.190951Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9b370dc51408a260936000ad6af73b9c5050a389ac7cba57831d2ea6cc96ffdd","observation_id":"dd28ad47-5f5d-446c-9af6-b2b9d975e6f5","resolution":{"observed_at":"2026-08-07T15:13:38.190951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:50.865566Z","title":"Milestones in autonomous driving and intelligent vehicles: Survey of surveys","venue":null,"work_id":"2e01efad-c911-4a77-9c5f-052fdc6ac40a","year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.291323Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:10bd9020712bc327cbc7f0b3a1587f07ae66ae9ed32bc7cf07411a33d64390c0","observation_id":"d2fb4b9c-c9e0-4703-89e4-3e604ed0c6d0","resolution":{"observed_at":"2026-08-07T15:13:50.991617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:50.569500Z","title":"Event-triggered model predictive control with deep reinforcement learning for autonomous driving","venue":null,"work_id":"b1506262-3353-44d7-8840-0b0a2ba88f15","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.501592Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:2f4917690f6826fdccb77bc8b6e5bda2651907586a6c5b64c16497534b3bc363","observation_id":"09ea864e-390f-4e7d-a28e-99d38fa1a72d","resolution":{"observed_at":"2026-08-07T15:13:50.702190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:50.413450Z","title":"Deep reinforcement learning with nmpc assistance nash switching for urban autonomous driving","venue":null,"work_id":"9c43a3ff-fbb3-4daa-b249-0e1e991ff85f","year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.617508Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:41d542f8d9f39cbb4f00ee0a7da34abf74df44ae8b512509cb42193bfb2b30a3","observation_id":"4d6fcc8d-e843-4e4e-af27-db0d689266da","resolution":{"observed_at":"2026-08-07T15:13:50.508191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:38.717304Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.717304Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:f565fc409eda6266fbec1fa8c548663bf48fe1b296ef9ad69644918f5f5b9688","observation_id":"f3defba4-44d7-4ada-9197-f848bd7dcbc0","resolution":{"observed_at":"2026-08-07T15:13:38.717304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:13:38.938324Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:38.938324Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:918d0f80f3582a03d4a879f3a434ab13f2d674cbaa24aee4dc4eac669f5e03df","observation_id":"0275447b-62ec-49de-8395-410dab057a5e","resolution":{"observed_at":"2026-08-07T15:13:38.938324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02361","last_updated":"2019-06-06T00:02:37Z","snapshot_observed_at":"2026-08-14T16:20:06.817362Z","submitted_at":"2019-06-06T00:02:37Z","title":"Explain Yourself! Leveraging Language Models for Commonsense Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.02361","snapshot_observed_at":"2026-08-07T15:13:39.086618Z","title":"Explain yourself! leveraging language models for commonsense reasoning","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.086618Z"},"links":{"cited_paper":"/paper/1906.02361","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:f4ed8f87c1dea556a2538dfd35fac515fe62f167a150edf055caddb63ac3f018","observation_id":"b8f3bdbb-7e1e-4f7f-a01c-f7b19cb183a8","resolution":{"observed_at":"2026-08-07T15:13:39.086618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11207","last_updated":"2023-10-17T12:34:32Z","snapshot_observed_at":"2026-08-13T07:29:41.812673Z","submitted_at":"2023-10-17T12:34:32Z","title":"Can Large Language Models Explain Themselves? A Study of LLM-Generated Self-Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11207","snapshot_observed_at":"2026-08-07T15:13:39.160195Z","title":"Can large language models explain themselves? a study of llm-generated self-explanations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.160195Z"},"links":{"cited_paper":"/paper/2310.11207","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:952c751f44c51686f439b9804384388c845a8d0c1f926225c80fa3676a97b732","observation_id":"f7eb0243-a63e-4bfe-9e2b-a2af77a3eb0a","resolution":{"observed_at":"2026-08-07T15:13:39.160195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:13:39.232635Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.232635Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9cd4b34705d36df384b0887cf3fa65ff31768c23e79eb31f82ae4dd983eab02b","observation_id":"bce1d8a1-66bd-4254-8282-05cb920efc09","resolution":{"observed_at":"2026-08-07T15:13:39.232635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-07T15:13:39.381567Z","title":"Deepseek llm: Scaling open-source language models with longtermism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.381567Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:579c48a17fb285927d33cfc5faa5d0674561152d2d12c08f25906092e0fb35fd","observation_id":"4ee9c737-24d7-4521-a350-52090cc44a5a","resolution":{"observed_at":"2026-08-07T15:13:39.381567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:13:39.513175Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.513175Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:cfc46e83a4da6d8018d8dfbddf1df7ade4695fe557662756aadf87b8b2bcd372","observation_id":"78af3939-c290-4f45-b8ad-fafe89bd5cda","resolution":{"observed_at":"2026-08-07T15:13:39.513175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:50.232698Z","title":"Limsim++: A closed-loop platform for deploying multimodal llms in autonomous driving","venue":null,"work_id":"e746ae10-96df-43d9-bb9f-8a043027b41f","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.649174Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:bb3bd96b91d4e2a0c737d4357973663faddee71c6093e70b15f6cf8cf518f7ec","observation_id":"55b60325-e9b7-4c16-a5ea-122aa48d87cf","resolution":{"observed_at":"2026-08-07T15:13:50.317088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:50.029608Z","title":"Lampilot: An open benchmark dataset for autonomous driving with language model programs","venue":null,"work_id":"516d451c-17a0-492a-af8f-404217eb1cd3","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.724284Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:7fac5342f0e0d1ad56dba79ef4bc61f9b4eda95d8dbb69cb56b6b273c5477b62","observation_id":"88f47f00-536c-4284-ba38-83acc0b6a09d","resolution":{"observed_at":"2026-08-07T15:13:50.125958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00415","last_updated":"2024-08-01T09:32:01Z","snapshot_observed_at":"2026-08-12T23:10:23.734881Z","submitted_at":"2024-08-01T09:32:01Z","title":"DriveArena: A Closed-loop Generative Simulation Platform for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00415","snapshot_observed_at":"2026-08-07T15:13:39.870729Z","title":"Drivearena: A closed-loop generative simulation platform for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:39.870729Z"},"links":{"cited_paper":"/paper/2408.00415","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:bbc64a8f99d8442be7d52467da52dba2ece3dfb7932c86305ee5d1cb5be3898b","observation_id":"2b00062c-5c10-4411-b073-9d8a3d1485ca","resolution":{"observed_at":"2026-08-07T15:13:39.870729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:40.028157Z","title":"Driving with llms: Fusing object-level vector modality for explainable autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.028157Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:e37b48f262061308a21df981563e7f916ba50e5b0a3964031904bf403c02a658","observation_id":"a137705b-f166-4471-b83e-099d205cdab0","resolution":{"observed_at":"2026-08-07T15:13:40.028157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01043","last_updated":"2024-08-12T11:53:28Z","snapshot_observed_at":"2026-08-13T05:34:26.411422Z","submitted_at":"2023-11-02T07:23:33Z","title":"LLM4Drive: A Survey of Large Language Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01043","snapshot_observed_at":"2026-08-07T15:13:40.153066Z","title":"Llm4drive: A survey of large language models for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.153066Z"},"links":{"cited_paper":"/paper/2311.01043","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:60c899b6ccf992295d7194c011cbc9844ca5fc2edbcdfdd449cc3ff4e31d6c3c","observation_id":"dedc060e-f68f-46ea-a839-b7e2bbb88b15","resolution":{"observed_at":"2026-08-07T15:13:40.153066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:40.272522Z","title":"Survey on large language model-enhanced reinforcement learning: Concept, taxonomy, and methods","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.272522Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:4bf9452e779da4a8d325bebaf6e61baecaebf253d6b4aa33c31e51fe9b8f6d40","observation_id":"28a9d241-289f-4a2c-987c-3e51f00bef1a","resolution":{"observed_at":"2026-08-07T15:13:40.272522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15214","last_updated":"2025-02-21T05:01:30Z","snapshot_observed_at":"2026-08-07T17:59:51.255537Z","submitted_at":"2025-02-21T05:01:30Z","title":"The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.15214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.15214","snapshot_observed_at":"2026-08-07T15:13:46.454609Z","title":"The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning","venue":"cs.LG","work_id":"c7fcb0be-d127-40d9-b293-0b9c03513443","year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.383369Z"},"links":{"cited_paper":"/paper/2502.15214","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9f5adeb783bb824102b2332ae629c2c784f8e77ff05cdb9348ec601b6c3daf0c","observation_id":"bbb02410-a701-4f50-8c2a-5f685df8c4e4","resolution":{"observed_at":"2026-08-07T15:13:46.682510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12568","last_updated":"2024-10-20T04:35:34Z","snapshot_observed_at":"2026-08-12T22:21:51.264127Z","submitted_at":"2024-10-16T13:43:00Z","title":"Robust RL with LLM-Driven Data Synthesis and Policy Adaptation for Autonomous Driving","version":2},"cited_work":{"arxiv_id":"2410.12568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12568","snapshot_observed_at":"2026-08-07T15:13:46.216829Z","title":"Robust RL with LLM-Driven Data Synthesis and Policy Adaptation for Autonomous Driving","venue":"cs.RO","work_id":"facc4538-540e-4dbf-931b-1ff47020a4fe","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.499557Z"},"links":{"cited_paper":"/paper/2410.12568","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:a4f5394070c0ce4d6dc76604c1f04f95980bbca002b6e2199146f0634a5a1355","observation_id":"8bb67715-276b-401c-8a10-4e6772e4e2ac","resolution":{"observed_at":"2026-08-07T15:13:46.325224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13547","last_updated":"2024-05-22T11:32:37Z","snapshot_observed_at":"2026-08-13T00:02:16.705094Z","submitted_at":"2024-05-22T11:32:37Z","title":"HighwayLLM: Decision-Making and Navigation in Highway Driving with RL-Informed Language Model","version":1},"cited_work":{"arxiv_id":"2405.13547","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.13547","snapshot_observed_at":"2026-08-07T15:13:46.012182Z","title":"HighwayLLM: Decision-Making and Navigation in Highway Driving with RL-Informed Language Model","venue":"cs.RO","work_id":"eda128ec-b040-4e37-8c8d-58b70fde8c70","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.692441Z"},"links":{"cited_paper":"/paper/2405.13547","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:8a7f99ec6c18c47e29ea5eca7f6fbf97e66ea2c577282feb3e9ed9b009be7b82","observation_id":"3b0f2862-310e-474d-b8e6-c4f75ddf3572","resolution":{"observed_at":"2026-08-07T15:13:46.115841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07608","last_updated":"2025-03-10T17:59:42Z","snapshot_observed_at":"2026-08-01T16:55:41.453922Z","submitted_at":"2025-03-10T17:59:42Z","title":"AlphaDrive: Unleashing the Power of VLMs in Autonomous Driving via Reinforcement Learning and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07608","snapshot_observed_at":"2026-08-07T15:13:40.813952Z","title":"Alphadrive: Unleashing the power of vlms in autonomous driving via reinforcement learning and reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.813952Z"},"links":{"cited_paper":"/paper/2503.07608","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:d5c669993ff98f5d0625f18f45e89ace089ab678ab53d9ec6290fe4340c08bba","observation_id":"719611fb-4ff4-4c10-a221-4350bbb118fb","resolution":{"observed_at":"2026-08-07T15:13:40.813952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.816728Z","title":"Optimizing autonomous driving for safety: A human- centric approach with llm-enhanced rlhf","venue":null,"work_id":"4f21d3f7-7b5c-441f-84dc-6ce0bc7de3d5","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:40.932576Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:5a80e1a327fd9a00adf6dec21870039d78e990e6e0bb4458bb176a138b6467d4","observation_id":"d8c34570-3f2e-4e6e-b1f3-48ecccf7f080","resolution":{"observed_at":"2026-08-07T15:13:49.924665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15544","last_updated":"2024-12-20T04:08:11Z","snapshot_observed_at":"2026-08-13T01:32:47.516885Z","submitted_at":"2024-12-20T04:08:11Z","title":"VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15544","snapshot_observed_at":"2026-08-07T15:13:41.080485Z","title":"Vlm-rl: A unified vision language models and reinforcement learning framework for safe autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.080485Z"},"links":{"cited_paper":"/paper/2412.15544","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:30ca4f2c76c263221998eacacb3c1f95f294104ebd9e6cd7e9975887e1d90b4a","observation_id":"028119a4-8591-4506-b4d8-fd400be7334f","resolution":{"observed_at":"2026-08-07T15:13:41.080485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15119","last_updated":"2025-02-21T00:42:40Z","snapshot_observed_at":"2026-08-07T18:00:20.942750Z","submitted_at":"2025-02-21T00:42:40Z","title":"CurricuVLM: Towards Safe Autonomous Driving via Personalized Safety-Critical Curriculum Learning with Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15119","snapshot_observed_at":"2026-08-07T15:13:41.227622Z","title":"Curricuvlm: Towards safe autonomous driving via personalized safety-critical curriculum learning with vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.227622Z"},"links":{"cited_paper":"/paper/2502.15119","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:f76bef5be72e686374391417ee8667d4e2e587ccf6c16c23de63178209759637","observation_id":"4f77f1af-e24f-4541-94ba-e7b2d231e8be","resolution":{"observed_at":"2026-08-07T15:13:41.227622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18511","last_updated":"2024-12-24T15:50:10Z","snapshot_observed_at":"2026-08-14T18:28:45.072376Z","submitted_at":"2024-12-24T15:50:10Z","title":"Large Language Model guided Deep Reinforcement Learning for Decision Making in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18511","snapshot_observed_at":"2026-08-07T15:13:41.382693Z","title":"Large language model guided deep reinforcement learning for decision making in autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.382693Z"},"links":{"cited_paper":"/paper/2412.18511","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:c8075394512c3301455aa20545f6daea233f547feab89bccc76b40e82e5980fd","observation_id":"65197cca-5cf8-4ba5-975b-8edfac03eb4c","resolution":{"observed_at":"2026-08-07T15:13:41.382693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05057","last_updated":"2025-01-09T08:28:16Z","snapshot_observed_at":"2026-08-12T16:50:03.169243Z","submitted_at":"2025-01-09T08:28:16Z","title":"LearningFlow: Automated Policy Learning Workflow for Urban Driving with Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.05057","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.05057","snapshot_observed_at":"2026-08-07T15:13:45.789156Z","title":"LearningFlow: Automated Policy Learning Workflow for Urban Driving with Large Language Models","venue":"cs.RO","work_id":"abd671f5-6cb2-418b-990c-4f6e3ad542e2","year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.473724Z"},"links":{"cited_paper":"/paper/2501.05057","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:65b34fe07f9b5ace691c88d021b1113dc13afb471006eb01532716f21fcf16cb","observation_id":"eedf6962-2325-4712-84a7-9fae99fe9538","resolution":{"observed_at":"2026-08-07T15:13:45.844889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.643532Z","title":"Autoreward: Closed-loop reward design with large language models for autonomous driving","venue":null,"work_id":"f197729f-6ec6-4f42-b6df-b20e800b9888","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.537346Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:12ce1bbbccba8e857c7d727c08317c04f8db2819ee27b74c1d0985eb03544bec","observation_id":"c08755b0-b041-4819-8163-c018abebf8ee","resolution":{"observed_at":"2026-08-07T15:13:49.714848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16201","last_updated":"2024-12-17T00:12:45Z","snapshot_observed_at":"2026-08-14T04:20:06.939014Z","submitted_at":"2024-12-17T00:12:45Z","title":"CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16201","snapshot_observed_at":"2026-08-07T15:13:41.718661Z","title":"Clip-rldrive: Human-aligned autonomous driving via clip-based reward shaping in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.718661Z"},"links":{"cited_paper":"/paper/2412.16201","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:83432eac7a2e562aebf22cccd85a5936c0d6ee5158b9cb160c205e9dfda561d3","observation_id":"c6dafbe8-d84c-488d-a6ec-cc2581ec03af","resolution":{"observed_at":"2026-08-07T15:13:41.718661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.521938Z","title":"Lord: Large models based opposite reward design for autonomous driving","venue":null,"work_id":"8a021b96-48df-4603-8604-498612af3366","year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:41.859641Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:af90a39aaa86df4e94f9699275dd49c016ffd58fd7602858ed371b958347d242","observation_id":"de4a2223-a3f9-40ad-a2c7-57e517325fb0","resolution":{"observed_at":"2026-08-07T15:13:49.575694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.389201Z","title":"Revolve: Reward evolution with large language models for autonomous driving","venue":null,"work_id":"0a073e55-39ae-4a65-9996-328e46394b7e","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.042418Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:1225d0549427dca604e82f5657616fa66201a9d97c62e8512b118396a14acee7","observation_id":"25070fe4-6866-4766-89c1-5049edc80bd4","resolution":{"observed_at":"2026-08-07T15:13:49.439504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02707","last_updated":"2025-05-18T11:18:56Z","snapshot_observed_at":"2026-08-13T04:53:43.321583Z","submitted_at":"2024-10-03T17:31:31Z","title":"LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02707","snapshot_observed_at":"2026-08-07T15:13:42.187476Z","title":"Llms know more than they show: On the intrinsic representation of llm hallucinations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.187476Z"},"links":{"cited_paper":"/paper/2410.02707","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:e35e8ff8734f4f81e29a3fcae69eed775a45a32ac6587ac1564e480c5f826e1a","observation_id":"4c469ab0-84ef-4ea2-a378-04983c3998fa","resolution":{"observed_at":"2026-08-07T15:13:42.187476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13684","last_updated":"2024-05-22T14:25:41Z","snapshot_observed_at":"2026-08-13T00:02:08.056768Z","submitted_at":"2024-05-22T14:25:41Z","title":"CrossCheckGPT: Universal Hallucination Ranking for Multimodal Foundation Models","version":1},"cited_work":{"arxiv_id":"2405.13684","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.13684","snapshot_observed_at":"2026-08-07T15:13:45.556338Z","title":"CrossCheckGPT: Universal Hallucination Ranking for Multimodal Foundation Models","venue":"cs.CL","work_id":"dba66017-d320-4053-adb1-05c672c5def9","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.283847Z"},"links":{"cited_paper":"/paper/2405.13684","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9012ffe9027ab4f7a13ee3726263756737ec58ea3b5dcbd781ae0a4af205b082","observation_id":"51089c0c-b0b6-4b7e-88ff-5d6cb44f2434","resolution":{"observed_at":"2026-08-07T15:13:45.640239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20550","last_updated":"2025-01-17T01:44:44Z","snapshot_observed_at":"2026-08-12T22:34:03.566020Z","submitted_at":"2024-09-30T17:51:15Z","title":"LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20550","snapshot_observed_at":"2026-08-07T15:13:42.420652Z","title":"Llm hallucinations in practical code generation: Phenomena, mechanism, and mitigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.420652Z"},"links":{"cited_paper":"/paper/2409.20550","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:2afe0ca03bb0cb8e6b3be964f73680c1507998d8cd198b13928c719a54261959","observation_id":"04727cb5-68c5-4358-9e31-298b38c9dac5","resolution":{"observed_at":"2026-08-07T15:13:42.420652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:42.543190Z","title":"Exploring and evaluating hallucinations in llm-powered code generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.543190Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:ec7cd16a41f356b4ef279346752549e4961aef855a50701085697b7f0d4425ce","observation_id":"08e6e69b-2aeb-438e-baf7-85869b80993c","resolution":{"observed_at":"2026-08-07T15:13:42.543190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.242715Z","title":"Llm-check: Investigating detection of hallucinations in large language models","venue":null,"work_id":"4981e477-3db6-4150-aee0-7736da54f5e9","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.589997Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:12f6f89594b76e1399c1a4a5417cd07de8cf9467de78f2f201277009bf6ca769","observation_id":"61c8658f-51b8-47dc-871c-ec81121c270f","resolution":{"observed_at":"2026-08-07T15:13:49.318571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23765","last_updated":"2025-07-17T03:46:15Z","snapshot_observed_at":"2026-08-11T10:07:56.752381Z","submitted_at":"2025-03-31T06:30:35Z","title":"STI-Bench: Are MLLMs Ready for Precise Spatial-Temporal World Understanding?","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23765","snapshot_observed_at":"2026-08-07T15:13:42.676327Z","title":"Sti-bench: Are mllms ready for precise spatial-temporal world understanding? arXiv preprint arXiv:2503.23765, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.676327Z"},"links":{"cited_paper":"/paper/2503.23765","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:c59ccc2056e52db94d33f045cf2530c16864639d2415227380e9408f725a680e","observation_id":"2347f6aa-ac5a-4b8b-a3da-97312c56f293","resolution":{"observed_at":"2026-08-07T15:13:42.676327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:49.059672Z","title":"Rladapter: Bridging large language models to reinforcement learning in open worlds","venue":null,"work_id":"8b0ef3cd-ef35-4798-830d-84e94db4b396","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.860628Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:8651a8d70f728636dd82edbb825841bd19cb267e6d43536f5cafcb19e9047fd8","observation_id":"d8f7bdbf-a887-488d-a79a-3bbfa68c98ea","resolution":{"observed_at":"2026-08-07T15:13:49.135974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:42.954660Z","title":"Pre-trained language models for interactive decision-making","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:42.954660Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:27e3cd66833c89d686dced85cc425f46401fd8ebfb86907e9d80ef1845ee275d","observation_id":"386ce246-dca3-4fd5-a1a8-e2456d0e1088","resolution":{"observed_at":"2026-08-07T15:13:42.954660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20587","last_updated":"2024-12-17T15:59:44Z","snapshot_observed_at":"2026-08-13T05:35:39.989247Z","submitted_at":"2023-10-31T16:24:17Z","title":"Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20587","snapshot_observed_at":"2026-08-07T15:13:43.083091Z","title":"Unleashing the power of pre-trained language models for offline reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.083091Z"},"links":{"cited_paper":"/paper/2310.20587","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:1ca75660156ef23a02e2a9f1a07f46e674042e37b6efbb28950459437d0fd2ec","observation_id":"6f3765b7-752a-414c-acc6-0bb795585cde","resolution":{"observed_at":"2026-08-07T15:13:43.083091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18127","last_updated":"2024-02-29T03:41:23Z","snapshot_observed_at":"2026-08-13T05:39:05.644882Z","submitted_at":"2023-10-27T13:19:19Z","title":"Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18127","snapshot_observed_at":"2026-08-07T15:13:43.182597Z","title":"Ask more, know better: Reinforce-learned prompt questions for decision making with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.182597Z"},"links":{"cited_paper":"/paper/2310.18127","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:cb8907bde6b4f9975e91e26d82a856f6c0be9e41c0006f77ed1230b6c3ea6794","observation_id":"0b0e9a00-1d26-47d0-8065-0e726e961abf","resolution":{"observed_at":"2026-08-07T15:13:43.182597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07927","last_updated":"2024-10-10T13:54:11Z","snapshot_observed_at":"2026-08-13T12:10:07.465310Z","submitted_at":"2024-10-10T13:54:11Z","title":"Efficient Reinforcement Learning with Large Language Model Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07927","snapshot_observed_at":"2026-08-07T15:13:43.329899Z","title":"Efficient reinforcement learning with large language model priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.329899Z"},"links":{"cited_paper":"/paper/2410.07927","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:eb82073fbaa958379a9d692a0599969ce47e39e50511ea2cee46b76f13e66678","observation_id":"305b7bed-a869-4f01-8ebc-60d8f37803b9","resolution":{"observed_at":"2026-08-07T15:13:43.329899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:48.834870Z","title":"Grounding large language models in interactive environments with online reinforcement learning","venue":null,"work_id":"58209b88-60f9-48b0-b080-98e368d6c1c5","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.429434Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:cf39fe9eba697ab180e61694b480da967828508b5e183641daeb6b9924af194e","observation_id":"a44a4276-8fdd-4bfc-b637-45f8fa8ca24e","resolution":{"observed_at":"2026-08-07T15:13:48.956077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:48.561891Z","title":"Fine-tuning large vision-language models as decision-making agents via reinforcement learning","venue":null,"work_id":"06c6ecbb-631a-4173-aa36-34c0dc0ec63e","year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.509924Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:8d9c3ff14942f54cb62a6657208e7e4306cbc4155f537dd7672fb11af28c5ecd","observation_id":"f8be9a38-554c-4843-ad3b-a756f3556c6b","resolution":{"observed_at":"2026-08-07T15:13:48.691903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04642","last_updated":"2024-03-07T16:36:29Z","snapshot_observed_at":"2026-08-13T00:59:58.573803Z","submitted_at":"2024-03-07T16:36:29Z","title":"Teaching Large Language Models to Reason with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04642","snapshot_observed_at":"2026-08-07T15:13:43.610133Z","title":"Teaching large language models to reason with reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.610133Z"},"links":{"cited_paper":"/paper/2403.04642","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:3e2845140627351325b6e0e55ebcdee4f66654cac07601f64c1de5fa3841c107","observation_id":"49fc1608-b320-4489-bbfa-ae4d409b03ac","resolution":{"observed_at":"2026-08-07T15:13:43.610133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:48.401387Z","title":"Latent reward: Llm-empowered credit assignment in episodic reinforcement learning","venue":null,"work_id":"4bac5c65-678d-49f1-a689-58a027a404d0","year":2025},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.722332Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:1833beb75a9f264b55d859d59a553843f422943760b4ea9f07d12d1bb413b8c8","observation_id":"39dd5d8d-80d1-4511-941a-70db42fcaf31","resolution":{"observed_at":"2026-08-07T15:13:48.459332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11489","last_updated":"2024-05-25T06:42:10Z","snapshot_observed_at":"2026-08-13T10:09:02.912910Z","submitted_at":"2023-09-20T17:39:13Z","title":"Text2Reward: Reward Shaping with Language Models for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11489","snapshot_observed_at":"2026-08-07T15:13:43.841984Z","title":"Text2reward: Reward shaping with language models for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.841984Z"},"links":{"cited_paper":"/paper/2309.11489","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:97b54d154730c7241d02ae471d8d3d9c7d1ef8089a2ac28f0abe758574523e06","observation_id":"869f221a-4444-4f51-bd69-bb2e6a21cab0","resolution":{"observed_at":"2026-08-07T15:13:43.841984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.12530","last_updated":"2022-10-22T19:09:18Z","snapshot_observed_at":"2026-08-13T22:26:54.688660Z","submitted_at":"2022-10-22T19:09:18Z","title":"LMPriors: Pre-Trained Language Models as Task-Specific Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.12530","snapshot_observed_at":"2026-08-07T15:13:43.958248Z","title":"Lmpriors: Pre-trained language models as task-specific priors","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:43.958248Z"},"links":{"cited_paper":"/paper/2210.12530","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:509fc6bd010e89c9e138f102124de403906b56483faa576bd5965a8d77e63ce5","observation_id":"e940e4c9-cec3-478d-ae1a-6dbb6b0c12ed","resolution":{"observed_at":"2026-08-07T15:13:43.958248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:47.726264Z","title":"Guiding pretraining in reinforcement learning with large language models","venue":null,"work_id":"2dc5a530-0f67-4605-a81a-7850e795efcd","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.043046Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9d6f572c4db1dafc051768633cd2aeff29f3221389eefd9e72b6be99ee72263c","observation_id":"c358db97-b953-4c50-a735-7a8a38bdc92e","resolution":{"observed_at":"2026-08-07T15:13:48.198912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-07T15:13:44.120140Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.120140Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:c862d1d66bda7560fa40d3380028dd015e8544d2848de010c99ae553178ae3b9","observation_id":"8ac7e83e-5021-4a5d-8aa8-a77f1b2d40bf","resolution":{"observed_at":"2026-08-07T15:13:44.120140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.247133Z","title":"Shufflenet v2: Practical guidelines for efficient cnn architecture design","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.247133Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:46206bcf3d292e28dd9df8a957ba02b095d1e1fb83e29ab702277b0b7281613f","observation_id":"649aa1a4-53e4-4146-b8c7-1144ed8be791","resolution":{"observed_at":"2026-08-07T15:13:44.247133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:13:44.372579Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.372579Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:bfd713704c9e58eaf74d57a2ee55cc1be2ed027d654e16d70190beda4b9d8236","observation_id":"4999fcf0-a1ce-451e-a25a-a8d5fd7f9ba5","resolution":{"observed_at":"2026-08-07T15:13:44.372579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.417563Z","title":"Retrieval-augmented generation for knowledge- intensive nlp tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.417563Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:5e62aaec29abac88a6ba86f2bf172554ba9a169a21333bef61ae4f764c6e95cd","observation_id":"df58aec2-3e55-45fb-8d7e-0f58277e824d","resolution":{"observed_at":"2026-08-07T15:13:44.417563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.473392Z","title":"Driving with regulation: Interpretable decision-making for autonomous vehicles with retrieval-augmented reasoning via llm","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.473392Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:9b90014d78155a74307d74060975344cafa64ff38e7270b2d9e4d4b5de79dc11","observation_id":"df81cc2c-9184-42ad-8da9-b16693c0deb5","resolution":{"observed_at":"2026-08-07T15:13:44.473392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.607686Z","title":"Rag-driver: Generalisable driving explanations with retrieval-augmented in-context learning in multi-modal large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.607686Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:a88bf02d06dff5e7f6c31dcd9c87ad78378da96f21a77e1458a0bf12ff14e79a","observation_id":"8107abfc-1589-46f6-a2e0-3326276dc0bf","resolution":{"observed_at":"2026-08-07T15:13:44.607686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.726077Z","title":"Billion-scale similarity search with gpus","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.726077Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:3e595fc97b07fdcfdf7d3b2117590234f95ebd02417ec49fcc38f2e1bda490f3","observation_id":"aca40825-2ce7-436a-b106-689c7f1c11e9","resolution":{"observed_at":"2026-08-07T15:13:44.726077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:44.834069Z","title":"Carla: An open urban driving simulator","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.834069Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:23b5a1858c916eb2db2ccb3a09cfaab60443878ac7446e906e0f557f9c17bde5","observation_id":"91c11edf-32d0-4aae-bb79-d51caa1c1e9a","resolution":{"observed_at":"2026-08-07T15:13:44.834069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:47.531652Z","title":"An end-to-end curriculum learning approach for autonomous driving scenarios","venue":null,"work_id":"8e7813a9-3919-4e1c-b0b4-a62c3f17c6e0","year":2022},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:44.950989Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:213f50e698d44f84afc888b958c39959479eeede629f63ad0c11ddf1159d6b98","observation_id":"5b5fd332-5878-418a-bd71-ba438cc30a95","resolution":{"observed_at":"2026-08-07T15:13:47.587803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:13:47.324377Z","title":"Standards for passenger comfort in automated vehicles: Acceleration and jerk","venue":null,"work_id":"953fe234-62ca-42fe-929a-e2d4b92ce117","year":2023},"citing_paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:13:45.072007Z"},"links":{"citing_paper":"/paper/2505.15793"},"observation_digest":"sha256:c9e792e7ba65713073652943c7a3048feb25480cc13b8fc49fc519ab1b8c5195","observation_id":"1b51b106-22e6-48b1-b840-d293a1d5ee2a","resolution":{"observed_at":"2026-08-07T15:13:47.450614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15793","last_updated":"2025-05-22T04:48:12Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T07:29:58.815034Z","submitted_at":"2025-05-21T17:47:24Z","title":"HCRMP: A LLM-Hinted Contextual Reinforcement Learning Framework for Autonomous Driving"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":5,"verified_fuzzy":18},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2505.15793."}