{"as_of":"2026-08-20T07:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:715c9c1174d005414b87888a8b91dab9b2ddc995f043c278d5b8a488a98ac0f7","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:16:02.508018Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T07:56:55.207988Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05223","snapshot_observed_at":"2026-08-03T07:56:55.207988Z","title":"[Brewittet al., 2021 ] Cillian Brewitt, Balint Gyevnar, Samuel Garcin, and Stefano V Albrecht","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.18783","last_updated":"2026-06-01T08:59:51Z","snapshot_observed_at":"2026-08-19T18:01:32.999527Z","submitted_at":"2026-01-26T18:50:21Z","title":"Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T07:56:55.207988Z"},"links":{"cited_paper":"/paper/2505.05223","citing_paper":"/paper/2601.18783"},"observation_digest":"sha256:38ed25eaaa5d15a3ce2a9b772915ae5dd2847fb7af69f8818e03fe45dd913caa","observation_id":"1900112c-9271-406c-be81-4b597eb4bb36","resolution":{"observed_at":"2026-08-03T07:56:55.207988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05223/citation-record","integrity":"/paper/2505.05223/integrity","json":"/paper/2505.05223/citation-record.json","paper":"/paper/2505.05223"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-16T10:28:44.439043Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-15T23:16:02.338693Z","title":"Emma: End-to-end multimodal model for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.338693Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:019a0c77e24a9288609c5528d4cd5fa34c404766a6e88baed750362ddc45cf50","observation_id":"ad383949-887f-4019-bb93-1a9636220cbd","resolution":{"observed_at":"2026-08-15T23:16:02.338693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-08-18T07:57:58.891611Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-08-15T23:16:02.343595Z","title":"Hydra-mdp: End-to-end multimodal planning with multi-target hydra-distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.343595Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:41e4cab7718a168cee2c2697f5a0d68fc80e8aae7c02646e490641192567e93b","observation_id":"7cb0c473-c98e-4ce3-a4f2-9c7e6e023075","resolution":{"observed_at":"2026-08-15T23:16:02.343595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.041138Z","title":"Exploration of the acceptability of different behaviors of an autonomous vehicle in so- called conflict situations,","venue":null,"work_id":"fe4519bc-8168-45da-94bc-80d3eea1ad88","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.348259Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:3a6495966912e6c1337767430332023c53089e25a02d9c6ed367a6b947857078","observation_id":"c000b252-6596-455f-b3fb-9ed1e5608049","resolution":{"observed_at":"2026-08-15T23:16:03.045317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.028622Z","title":"Toward adaptive driving styles for automated driving with users’ trust and preferences,","venue":null,"work_id":"fde908e5-9fb3-4be0-a90e-6da482a85901","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.352545Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:e3200d53aed406b1c827f5f624dac04bb7ed4fd52059a2acafb7080426e3be70","observation_id":"9b8308ee-e764-448e-94a9-b2a5afaaa5ac","resolution":{"observed_at":"2026-08-15T23:16:03.032982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.015850Z","title":"Dynamic preferences in multi-criteria reinforcement learning,","venue":null,"work_id":"7b69bb04-fe37-4ef7-985b-250e8c41c468","year":2005},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.356847Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:ed51f0aab9f600b9cc6271001433794adf1ee32cbcb9691f422dee78955caa6f","observation_id":"1f821b89-b78b-4131-8082-1a0987c9c465","resolution":{"observed_at":"2026-08-15T23:16:03.020086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.002850Z","title":"User-driven adaptation: Tailoring autonomous driving systems with dynamic preferences,","venue":null,"work_id":"0c586443-270a-4b24-af50-617fbff34869","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.361314Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:22bab476562129e4780047c343c10c90bdac2cc524f8f1234675b5e9733c0f49","observation_id":"ad0da834-c7b7-4646-aa04-8679a1a27232","resolution":{"observed_at":"2026-08-15T23:16:03.007284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.989482Z","title":"Lexicographic actor-critic deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"48dd8f39-4103-4cca-a2a6-0ca9892c514a","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.365838Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:0971b051c05636df575397030519fc40ab8353d8f6c932c07d103ed5e0959871","observation_id":"74ca8899-4174-4077-94ca-9f81b41b4ad4","resolution":{"observed_at":"2026-08-15T23:16:02.993583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.975758Z","title":"Urban driving with multi-objective deep reinforcement learning,","venue":null,"work_id":"e21f0148-6166-4c21-bc77-b614016166b0","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.369853Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:61048f0cd96d846954c83452212d74f9900433365414aa66afd831ecb166bf6c","observation_id":"561aff21-84e3-4f70-b97e-cfcc37937302","resolution":{"observed_at":"2026-08-15T23:16:02.980632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.964078Z","title":"Multi-objective optimization for autonomous driving strategy based on deep q network,","venue":null,"work_id":"cdd4aba0-d43f-46ec-a493-0d6f1588194c","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.373974Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:62af8afcef1c5e2ff78e70babd89668ef15b08979dd4067868f08a6fa25e5d92","observation_id":"9057dfde-ce7d-42ae-99ec-e63efff497c7","resolution":{"observed_at":"2026-08-15T23:16:02.968134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.951664Z","title":"Porf-ddpg: Learning per- sonalized autonomous driving behavior with progressively optimized reward function,","venue":null,"work_id":"9f4a6224-196f-46ca-a18f-3f495a764e32","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.377826Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:f8d23980feb6079d4515ed14bc33a0823ee9a67eb171cb1cd815a1a9261c9781","observation_id":"7ba0fb0b-5426-400c-98aa-63f308bbf733","resolution":{"observed_at":"2026-08-15T23:16:02.955898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.937180Z","title":"Toward personalized decision making for au- tonomous vehicles: A constrained multi-objective reinforcement learn- ing technique,","venue":null,"work_id":"1da2d1bd-f6b5-47ec-bce9-017086839561","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.382721Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:829364fe5aff4e4fa51af8112f9f4c800b15d2744a6ee47617a1ff568bb8c6ba","observation_id":"e8863148-8459-43b0-8895-bf55974af567","resolution":{"observed_at":"2026-08-15T23:16:02.941621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.924800Z","title":"Navigation in urban environments amongst pedestrians using multi-objective deep reinforcement learning,","venue":null,"work_id":"64f693f9-0059-4c4b-a96c-4b1cfa9a5700","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.387662Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:1516beacf4a722ee5fcff9462d47b3ae3541bbae8b751e6a3c32b6d512eca50b","observation_id":"359bb56b-463c-4afd-b6d9-14ac331dc0f3","resolution":{"observed_at":"2026-08-15T23:16:02.928714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.912817Z","title":"Learning driving styles for autonomous vehicles from demonstration,","venue":null,"work_id":"98da9f34-8fc4-40de-803c-1f1c71e8810c","year":2015},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.391875Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:601e70ef753476b946e8d2158a6f3009cc7e0ee87849559f4eb82ae132b1ec74","observation_id":"4ffd992c-fd44-4375-93c1-19262e8ad85b","resolution":{"observed_at":"2026-08-15T23:16:02.916769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.900298Z","title":"Driving behavior modeling using naturalistic human driving data with inverse reinforcement learning,","venue":null,"work_id":"45d18558-4144-430d-81d0-b317e092cefa","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.395812Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:dbbadbe0dc903f7b20d5b8f7fc5b8832009f8bead3e05aeef50924c284b3b44e","observation_id":"c53b48f1-6e2c-4df3-9957-af718f030752","resolution":{"observed_at":"2026-08-15T23:16:02.904524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.887483Z","title":"Driving with style: Inverse reinforcement learning in general-purpose planning for automated driving,","venue":null,"work_id":"005048d2-4bc1-44fe-a600-beeb44db5bd1","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.399629Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:f3104586d2d4d9df769bbe45c95819dccf6f22c570a2cf0f303d87785df28b5a","observation_id":"1423acff-d206-4a2d-804c-0c761061c7f3","resolution":{"observed_at":"2026-08-15T23:16:02.891938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.873396Z","title":"Driving style alignment for llm-powered driver agent,","venue":null,"work_id":"33d4f942-9c34-4a73-8d48-93c3155fbcdb","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.404163Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:1f8f806c9e054b5e9ca8860efcd58a01b086548c5c3527eb0266fef0f2541828","observation_id":"077aad96-d089-4b42-aa63-6a5bcef9b9b0","resolution":{"observed_at":"2026-08-15T23:16:02.878217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11694","last_updated":"2024-09-18T04:30:47Z","snapshot_observed_at":"2026-08-19T18:01:35.720931Z","submitted_at":"2024-09-18T04:30:47Z","title":"From Words to Wheels: Automated Style-Customized Policy Generation for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11694","snapshot_observed_at":"2026-08-15T23:16:02.408877Z","title":"From words to wheels: Automated style-customized policy generation for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.408877Z"},"links":{"cited_paper":"/paper/2409.11694","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:be16824ca54f4da4efc44fb9d82d6214f5b999561d2f0421a5e23c3ab43cb50c","observation_id":"e58df251-3ad6-4a32-9413-beb472a2ee20","resolution":{"observed_at":"2026-08-15T23:16:02.408877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11913","last_updated":"2024-11-17T23:20:37Z","snapshot_observed_at":"2026-08-20T01:19:29.700788Z","submitted_at":"2024-11-17T23:20:37Z","title":"On-Board Vision-Language Models for Personalized Autonomous Vehicle Motion Control: System Design and Real-World Validation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11913","snapshot_observed_at":"2026-08-15T23:16:02.413186Z","title":"On-board vision-language models for personalized autonomous vehicle motion control: System design and real-world validation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.413186Z"},"links":{"cited_paper":"/paper/2411.11913","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:324a3840b153ff3f3a92ae87e4e8c55e58668922d8aab46a181232439a21de5f","observation_id":"2cd0e7ed-9cd2-49bd-83f5-33ce5f9114ce","resolution":{"observed_at":"2026-08-15T23:16:02.413186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.417498Z","title":"A review of personalization in driving behavior: Dataset, modeling, and validation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.417498Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:1badf6b7d1e8c7d78d7d647b04c9f51a750a7f7ebc1b2590ce8ce71dd20461fa","observation_id":"4a412504-22b3-4a57-939a-8de803e1b85a","resolution":{"observed_at":"2026-08-15T23:16:02.417498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.852762Z","title":"Self-driving like a human driver instead of a robocar: Personalized comfortable driving experience for autonomous vehicles,","venue":null,"work_id":"efa55e1a-9332-4c5b-9f97-18a186e26b64","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.421125Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:5b666ec57a6ec7851683e9c9203105e5a1bf1302c909f20d57242a7984ae6241","observation_id":"35a5f31f-0610-44e8-bf7e-30c1c02e7ea3","resolution":{"observed_at":"2026-08-15T23:16:02.856960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.839082Z","title":"Toward safe and personal- ized autonomous driving: Decision-making and motion control with dpf and cdt techniques,","venue":null,"work_id":"31f7305c-5e88-44e9-a34d-4860117999dd","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.425361Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:211e49efc01297325b6f2be83511cb7b92d098ad460a675fe7e9f3fd6c21b9b0","observation_id":"31e00388-de41-4c44-bf24-50ce56bda75d","resolution":{"observed_at":"2026-08-15T23:16:02.843565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.826384Z","title":"Personalized driving behavior oriented autonomous vehicle control for typical traffic situations,","venue":null,"work_id":"5d13b568-457f-4c84-9d40-3b5e0d224a84","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.429305Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:4b946f6e85a8dde2cb347fe299f7f63a1cb0eda71ab49cee4e9488dcff2cb16c","observation_id":"fc1b08bc-aacd-4417-aec8-26782f9708dc","resolution":{"observed_at":"2026-08-15T23:16:02.830825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.813980Z","title":"Recent advancements in end-to-end au- tonomous driving using deep learning: A survey,","venue":null,"work_id":"5218496c-f988-4ccf-bee4-be8fd2f7ace8","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.433105Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8f34e53605ac7a8c827957f51480950bcaf894d1c34f799c5b435becea3dbb06","observation_id":"3ac28ce6-5244-4e55-b70e-9bd8db502ee2","resolution":{"observed_at":"2026-08-15T23:16:02.818302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.800948Z","title":"Personalized car following for autonomous driving with in- verse reinforcement learning,","venue":null,"work_id":"cfe27d34-561b-43e3-8464-b4afa06733b3","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.436703Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:fb31c72ea1932e18b747a3b70c986f00f44944adbfcbfe4e873b5d9fee6ed7c5","observation_id":"e0f0e82a-4893-47a1-94cc-6b1c92ea3347","resolution":{"observed_at":"2026-08-15T23:16:02.805244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.788116Z","title":"Text-to-drive: Diverse driving behavior synthesis via large language models,","venue":null,"work_id":"13acbaed-64a9-4311-8960-ffd6b1cc7046","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.440322Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:7826fbfe282f6dca42521248cbc7f43eeeadf6921a05bb8410403fb91536f8d0","observation_id":"042e9b7b-42dc-4411-af6e-6f70aeb325a1","resolution":{"observed_at":"2026-08-15T23:16:02.792782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.776004Z","title":"Multi-objective end-to-end self- driving based on pareto-optimal actor-critic approach,","venue":null,"work_id":"09fadbfc-9d5a-480d-b766-31927c84c97a","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.444019Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:ae1cd6f9ef97ede895110d180c036b495fb089db974fb185301e7357c053f825","observation_id":"66955f68-3c95-4bb5-8944-f43ad62f7f94","resolution":{"observed_at":"2026-08-15T23:16:02.780319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.764088Z","title":"PD-MORL: Preference-driven multi-objective reinforcement learning algorithm,","venue":null,"work_id":"4388f47d-8a16-4c1c-bd2f-fcff978f401d","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.447737Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:65cc2ce847deeb6ceb34c2fe86205b83f12c4ad9cbdb11e11bde623c0d52a391","observation_id":"957ab936-fa42-47e1-bae2-9839c6383484","resolution":{"observed_at":"2026-08-15T23:16:02.768130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.752834Z","title":"Demonstration- enhanced adaptable multi-objective robot navigation,","venue":null,"work_id":"48d363c6-2d90-4aec-9ef4-1b40c2ddb199","year":2025},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.451339Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8d725e74061028734fd2c0e20381ab9677929ca67f4f23eda6de675eb5a30c97","observation_id":"43a560af-2bcf-4774-a351-0af47448711e","resolution":{"observed_at":"2026-08-15T23:16:02.756710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.740563Z","title":"CARLA: An open urban driving simulator,","venue":null,"work_id":"43f01ffb-78db-4c39-966f-76fe4cfad697","year":2017},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.455744Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:19dfce0a551b0b2ebfdf798c7bafe3ab2be6c199c3808f01f7befc7d82e66846","observation_id":"e21630cf-681c-41c4-8282-39f7c81b8946","resolution":{"observed_at":"2026-08-15T23:16:02.744829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.727414Z","title":"A practical guide to multi-objective reinforcement learning and plan- ning,","venue":null,"work_id":"e2927d22-c3c2-43ab-a55a-e257ab059f38","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.460125Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:90b8ab8f4b302fb0ac9b1a66ee04136c0c8c8695348c6975a495512a370b9262","observation_id":"016b1561-a8e5-4fd4-b5c6-f4903730e1fc","resolution":{"observed_at":"2026-08-15T23:16:02.732009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.715538Z","title":"Prediction- guided multi-objective reinforcement learning for continuous robot control,","venue":null,"work_id":"53d5d955-a7aa-4d1b-adaf-8dd0bbdc2757","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.464087Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:38efb0b10f3e97c58b963febb4af73a668d6910cce08e04c361707d08d611d97","observation_id":"5d38c2ef-ec9e-46cd-b666-fb484394f327","resolution":{"observed_at":"2026-08-15T23:16:02.719502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.703320Z","title":"End-to- end reinforcement learning for autonomous longitudinal control using advantage actor critic with temporal context,","venue":null,"work_id":"20a031fd-e8ff-475a-9ca4-1b965567f6a3","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.467907Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:28674c5e000809e160961376ae40069cdb19e489238466cf5cba26cc41ae997a","observation_id":"3ad0a038-4514-4861-8603-5d8b84939a1f","resolution":{"observed_at":"2026-08-15T23:16:02.707534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.691098Z","title":"PASRL: Stabilising reinforcement learning with past action-state representation learning,","venue":null,"work_id":"73220257-8cb3-41ab-b964-cce2ff53ee7d","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.471935Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:c23c742c9a321576938994f1a777870f8fce46822cc3adbd0b339ba0435e4547","observation_id":"094a07a4-a3df-4b96-a1c8-4b72f70692cd","resolution":{"observed_at":"2026-08-15T23:16:02.695562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.679193Z","title":"Transfuser: Imitation with transformer-based sensor fusion for au- tonomous driving,","venue":null,"work_id":"b6bb1acf-ce0a-4bd7-96eb-2425ae5e2e7c","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.476483Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:95ff09c82e8b5aca54a16733afc73c08d1324b94d170ad6bfbb30c5879cd56cf","observation_id":"c8c4686a-a6ca-40b7-a822-04e2cf62706a","resolution":{"observed_at":"2026-08-15T23:16:02.683437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.480297Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.480297Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:6825118e03d1a0d5a5b4990f841d22f8f0ca40480ca237ca27a02b7bc82a4463","observation_id":"5318ac18-48f4-422b-aea7-b8a48da84e23","resolution":{"observed_at":"2026-08-15T23:16:02.480297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.660777Z","title":"Model-free deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"1f81bb0c-a58e-402e-8f82-5e72a91cae8e","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.483702Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:5018723f08b699dafcf461404da37e130d7cebffc4bbf2d9cc2d731d214c8e9b","observation_id":"587274d3-436a-407e-814d-fa257416c99b","resolution":{"observed_at":"2026-08-15T23:16:02.664667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.648739Z","title":"End-to-end model-free reinforcement learning for urban driving using implicit affordances,","venue":null,"work_id":"e26dc99f-de60-4516-bbe4-b4998c605007","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.488173Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:a6ae5b48feabe7c5a970742301d5f1af61e04b81b261d9ec2c95e6bd39f12d44","observation_id":"b67b49f6-58fd-4b0e-adea-6c47df2af612","resolution":{"observed_at":"2026-08-15T23:16:02.652997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.636369Z","title":"Prioritized experience-based reinforcement learning with human guidance for autonomous driving,","venue":null,"work_id":"58292191-a83a-47d3-af31-e797cdff0f03","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.492185Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:acdce2ad3e6267e6885c43d9af18341bad6e1e6e69e110cbed2857506aa96d5f","observation_id":"80df87dd-b42e-441c-88ee-c40488bd2841","resolution":{"observed_at":"2026-08-15T23:16:02.640310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.624325Z","title":"Carla leaderboard,","venue":null,"work_id":"58b86df7-e95c-4bd8-909b-ac8d9bf20c42","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.496103Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:bd2c6a0311004d781442e659b8f81ccf2100d64f745546a547425d3b02c55934","observation_id":"e99656ec-f3fe-4a2c-b7f7-5d5d62bcf63c","resolution":{"observed_at":"2026-08-15T23:16:02.628267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.611423Z","title":"Privileged sensing scaffolds reinforcement learning,","venue":null,"work_id":"742581c7-8623-41b4-a4e1-1f119de50065","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.499933Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:dd52bef633f375e40a4f48a9b5df4d646efe437f2cc27ae19dafb2e3dc677d6a","observation_id":"61b8e8d3-fe9b-4c68-a58f-1b1fa2ed24f0","resolution":{"observed_at":"2026-08-15T23:16:02.615953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.598099Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"ad035416-4c3e-4c01-a421-8bec357f172a","year":2015},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.504222Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:7140f523b034283f326dd46db6a524509e4fb07cf1c0a55524193a265154c915","observation_id":"b79813f8-753d-4a16-858a-d011556ba540","resolution":{"observed_at":"2026-08-15T23:16:02.603584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.584256Z","title":"Searching for MobileNetV3,","venue":null,"work_id":"8e70c33c-c249-415e-adce-110ccccceb85","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.508018Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:089c9c61813ca9a19db75166a8d874fac56465e09b5672d13c3f11d42c97ce72","observation_id":"33ec2fdd-b318-488b-b744-62bb9ab973b4","resolution":{"observed_at":"2026-08-15T23:16:02.589447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-19T18:00:16.667222Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.05223."}