{"as_of":"2026-08-15T19:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60a60d9210f035abc8cd86f30a489bf526dd98474d141665f168aae5031267c6","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:06:21.803962Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.15207/citation-record","integrity":"/paper/2508.15207/integrity","json":"/paper/2508.15207/citation-record.json","paper":"/paper/2508.15207"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.683187Z","title":"Google’s self-driving car caused its first crash,","venue":null,"work_id":"c011df85-03be-41c7-b5c0-1fda70e8c9bb","year":2016},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.054418Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:1efd538f9373e5971c5e6af04bab02f03555eb925d6a0058bc6ece034b435c8e","observation_id":"264b692a-95bf-46e2-ac61-519340b00c1e","resolution":{"observed_at":"2026-08-05T18:06:24.762552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T18:06:19.132220Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.132220Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:df945d4dda8318e70ab0202c5890cb9b0c6a22e1632f6ce0236065fae5bde5aa","observation_id":"4b6b0532-a916-4f97-a209-c3acb09bd230","resolution":{"observed_at":"2026-08-05T18:06:19.132220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.467518Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play,","venue":null,"work_id":"0c38521a-f343-405f-9b46-c62eee160fe5","year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.279134Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:868d96171a0db394e44536eb4ad49222f159a376b60a1659e458ce1abfe15ef5","observation_id":"93b01042-82c4-406d-9494-1ca35af77a26","resolution":{"observed_at":"2026-08-05T18:06:24.569321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.241358Z","title":"Control of a quadrotor with reinforcement learning,","venue":null,"work_id":"c524a852-082f-466a-876e-20dfea64bf20","year":2096},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.498251Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:72878cd6da27a39d0383daadcb90c21f4ab724afff8780f3f6904ab3359d09ba","observation_id":"52947855-e5ca-4456-81eb-b6c6286060da","resolution":{"observed_at":"2026-08-05T18:06:24.347666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-14T21:35:45.210326Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-05T18:06:19.594079Z","title":"Safe, multi- agent, reinforcement learning for autonomous driving,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.594079Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:848663fe1790b49704e0ff5dc253ec692c4210f25f32b3542412c2d4eb74bf5b","observation_id":"e8a13fdb-569f-4730-8c31-cb11d68e3880","resolution":{"observed_at":"2026-08-05T18:06:19.594079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.736231Z","title":"Deep reinforcement learning framework for autonomous driv- ing,","venue":null,"work_id":"3abd7c73-9c45-40c4-b1ee-a61179909650","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.774379Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:e4b1d8b5631c1ac0b4110812d35e61d0766b947047fbd7c6ba019a81486970ea","observation_id":"d07babeb-f4d1-4480-928e-ccd3756a7513","resolution":{"observed_at":"2026-08-05T18:06:23.854139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.529155Z","title":"Formulation of deep reinforcement learning architecture toward autonomous driving for on-ramp merge,","venue":null,"work_id":"1fa625d9-a328-4437-9b07-caee01edb2b2","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.061997Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:3323d2d56eb8f49fd5f5f06bad024888904749df659bc598091bbc558d98c66d","observation_id":"f165d015-6cde-478d-a211-3fa4fceddf05","resolution":{"observed_at":"2026-08-05T18:06:23.611712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.992917Z","title":"Deep rein- forcement learning framework for autonomous driving,","venue":null,"work_id":"cc9d8cf3-0af1-46eb-9da4-190447f4f456","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.174923Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:8dc996714685c3dbb283d71f0e0335c14c77bf67ae4ce1c6554c41596a9e5973","observation_id":"85ccae27-6318-47eb-bca3-cbc5fb7389c7","resolution":{"observed_at":"2026-08-05T18:06:24.106632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.296464Z","title":"Model-free deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"64d341b2-f386-4c68-a582-a6906975de30","year":2019},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.289914Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:edf2a4124ec95971ecb183536092e7d5ed8b97fa5bf4246216a9d43b266cd188","observation_id":"e9bf95a5-24b6-4131-b415-8a7843fa5926","resolution":{"observed_at":"2026-08-05T18:06:23.396785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02275","last_updated":"2020-03-14T20:33:00Z","snapshot_observed_at":"2026-08-14T20:55:28.847673Z","submitted_at":"2017-06-07T17:35:00Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02275","snapshot_observed_at":"2026-08-05T18:06:20.546964Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environ- ments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.546964Z"},"links":{"cited_paper":"/paper/1706.02275","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:4a3d2973045f10a2518f535fbb732795afdd73d4d63fc650fafadb9eef2d00f4","observation_id":"66b82ebf-efd8-412a-8eaf-817ff9d665d2","resolution":{"observed_at":"2026-08-05T18:06:20.546964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.107367Z","title":"Multi-agent connected autonomous driving using deep reinforcement learning,","venue":null,"work_id":"7ef0d53a-bafc-4295-8785-8c95e240ab1d","year":2020},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.613066Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:f0fbe2faa2c0b627f3d59bb282498563eba458fe468ef2c34a049d21632ae1cd","observation_id":"208f168d-7cd5-43fd-8948-4bf10d535744","resolution":{"observed_at":"2026-08-05T18:06:23.194787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:20.727499Z","title":"An environment for autonomous driving decision- making,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.727499Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:69bede02345c1168595f57c4216bae40918ebdfa8657c2b6145730a149a0ac7d","observation_id":"b8b05ac8-a726-4e68-9dd4-d911044e2d83","resolution":{"observed_at":"2026-08-05T18:06:20.727499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.861315Z","title":"Credit assignment for collective multiagent rl with global rewards,","venue":null,"work_id":"b6e5c955-a0ee-46c4-8c36-fcc74498951c","year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.805020Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:fa3e415f2b67562a35a40d16da48f93d960e854f2102e021aa3bb33b3c6ff0a2","observation_id":"8a079827-c55a-4833-9bed-7369c9948b0a","resolution":{"observed_at":"2026-08-05T18:06:22.980420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-05T18:06:20.918788Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.918788Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:1412a6ec418a85de1636fe6a85c4ae8c2f8e81b47730c06c64b72a33008c0a1d","observation_id":"7b032fa8-9915-4cd0-aa9d-43dfd17c58b0","resolution":{"observed_at":"2026-08-05T18:06:20.918788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.683559Z","title":"Robust adversar- ial reinforcement learning,","venue":null,"work_id":"0ea45df5-e1dc-474d-b1f3-3efe13dcd955","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.012650Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:3627d0d3b65c40622cb54b71885ece2ff8b5b7ecce57b40caa7d3dd552d29d0d","observation_id":"d722d826-37a2-4d68-a778-c79abe7dcb74","resolution":{"observed_at":"2026-08-05T18:06:22.770503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T18:06:21.126759Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.126759Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:1494b6690ef4ef22a27f28133c50dd7701653989bcf6c2e1b2b020e19cefd985","observation_id":"ee5788cb-a078-4948-97c3-e4ba22d924aa","resolution":{"observed_at":"2026-08-05T18:06:21.126759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:21.193791Z","title":"Trust region policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.193791Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:0259984cb5303b14db78dfe95e9e25fe7ab9cc87e42db4029dcc77ced59c7074","observation_id":"5fd5a101-8594-459f-9c70-b1519b8ad06d","resolution":{"observed_at":"2026-08-05T18:06:21.193791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.505752Z","title":"Double q-learning,","venue":null,"work_id":"7d65f451-6c25-4b38-9f6f-509f2c721877","year":null},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.331062Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:91bac0c34b5a01d4040bac6b2dbea14e249f42863cdf89c5f0655c7c4d889348","observation_id":"f5948e2d-1fe1-4c3a-bef9-a256ee1f2653","resolution":{"observed_at":"2026-08-05T18:06:22.571608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.06461","last_updated":"2015-12-08T21:19:16Z","snapshot_observed_at":"2026-08-14T22:31:25.126692Z","submitted_at":"2015-09-22T04:40:22Z","title":"Deep Reinforcement Learning with Double Q-learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.06461","snapshot_observed_at":"2026-08-05T18:06:21.530402Z","title":"Deep reinforcement learning with double q-learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.530402Z"},"links":{"cited_paper":"/paper/1509.06461","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:29399effbe9c18c091aa5c531dc41d630cc4df85cb9dae572e48d7fdf55b5f3e","observation_id":"6aa42f11-b567-4ec4-988d-c9e61f912d7b","resolution":{"observed_at":"2026-08-05T18:06:21.530402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09477","last_updated":"2018-10-22T17:37:07Z","snapshot_observed_at":"2026-08-15T15:36:54.161299Z","submitted_at":"2018-02-26T17:54:49Z","title":"Addressing Function Approximation Error in Actor-Critic Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09477","snapshot_observed_at":"2026-08-05T18:06:21.622214Z","title":"Addressing function approximation error in actor-critic methods,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.622214Z"},"links":{"cited_paper":"/paper/1802.09477","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:3438f82c2974cdf50c44650516f646cd8c33612e9b9329c8eb2d5e7c4c24d6fc","observation_id":"a58a6028-d235-4a0a-86ee-f777a02c4985","resolution":{"observed_at":"2026-08-05T18:06:21.622214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.086554Z","title":"General lane-changing model mobil for car-following models,","venue":null,"work_id":"4967eb5c-81b8-4ed5-b832-ea1711a6d903","year":1999},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.690871Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:5a197fccb1231b85faeeefefd523883590a6da77603357532434b12ca315f399","observation_id":"daac7fb7-af44-4a12-af6f-c22691381a86","resolution":{"observed_at":"2026-08-05T18:06:22.188142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:21.803962Z","title":"Congested traffic states in empirical observations and microscopic simulations,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.803962Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:6e43bb83aea8b022275d749a6bbe26547765458706c4a25d27be8b55aeba68d1","observation_id":"4268a574-b55c-4fec-82cb-315a9bc5624b","resolution":{"observed_at":"2026-08-05T18:06:21.803962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.254512Z","title":"Available: https://proceedings.neurips.cc/paper/2010/ file/091d584fced301b442654dd8c23b3fc9-Paper.pdf","venue":null,"work_id":"a07135ff-4f4f-440e-a7c3-b54a25ec0625","year":2010},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.434666Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:d15c96247d7d0516dda4980eb01d1708349e03e99be7470e3808534a94b74620","observation_id":"1abb735b-1f07-4d31-b938-d405f7c1ce7f","resolution":{"observed_at":"2026-08-05T18:06:22.377868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T18:24:49.496648Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2508.15207."}