{"as_of":"2026-08-21T11:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad2d38ab0ed848b4e12fb737aa785213dc59e6c7e292434b4cff946f85cbcf56","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:08:33.099836Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:06:02.123061Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-07T20:44:01.716477Z","title":"Robust autonomy emerges from self- play,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.10477","last_updated":"2025-05-22T13:27:22Z","snapshot_observed_at":"2026-08-14T23:26:29.078710Z","submitted_at":"2025-02-13T19:32:41Z","title":"Knowledge Integration Strategies in Autonomous Vehicle Prediction and Planning: A Comprehensive Survey","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T20:44:01.716477Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2502.10477"},"observation_digest":"sha256:c11c388d495c109b3144dd64c217a7896c0bbc16c1d8f7b52d7828deb1544256","observation_id":"86e3f049-2f6d-4614-b10b-77efe135a7be","resolution":{"observed_at":"2026-08-07T20:44:01.716477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-16T12:06:02.123061Z","title":"Robust autonomy emerges from self-play,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13785","last_updated":"2025-04-18T16:35:12Z","snapshot_observed_at":"2026-08-17T23:19:17.051289Z","submitted_at":"2025-04-18T16:35:12Z","title":"Learning Through Retrospection: Improving Trajectory Prediction for Automated Driving with Error Feedback","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:06:02.123061Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2504.13785"},"observation_digest":"sha256:44bfbf8db7a6a4e2bb27b40eb3a200fa8d537212f6eef34abeb4d4054f8db405","observation_id":"7b5e9c16-b0ac-4ae5-b037-9702b09565d1","resolution":{"observed_at":"2026-08-16T12:06:02.123061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2504.13818","last_updated":"2026-04-22T00:26:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-18T17:49:55Z","title":"Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T18:46:11.571831Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2504.13818"},"observation_digest":"sha256:513b0da2962a0dd16f91123ed0cf4617aaee21f247f46c18191c6f36dbef6ddf","observation_id":"c266118a-6eb4-4c4e-bef6-301b6503384c","resolution":{"observed_at":"2026-05-22T18:46:57.129172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-16T10:40:50.279677Z","title":"Cusumano-Towner, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17838","last_updated":"2025-08-20T19:00:45Z","snapshot_observed_at":"2026-08-18T19:05:02.303169Z","submitted_at":"2025-04-24T17:56:01Z","title":"CaRL: Learning Scalable Planning Policies with Simple Rewards","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:50.279677Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2504.17838"},"observation_digest":"sha256:210a4823d5ad4bdda572b670d6fc5dda089342ad07d09039bd2b692682b9537f","observation_id":"6236b8c8-c3ae-4f4f-9491-e21250568153","resolution":{"observed_at":"2026-08-16T10:40:50.279677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-07T11:22:12.059284Z","title":"Robust autonomy emerges from self-play, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03225","last_updated":"2025-07-17T15:41:03Z","snapshot_observed_at":"2026-08-15T05:48:13.479991Z","submitted_at":"2025-06-03T11:19:21Z","title":"Multiple-Frequencies Population-Based Training","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:22:12.059284Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2506.03225"},"observation_digest":"sha256:b41506cfa6d3b3a106c23f4b2183ed4f257bd026bb17492820e775237bfe8190","observation_id":"8156596f-6c89-4e73-88de-d91278db7eb1","resolution":{"observed_at":"2026-08-07T11:22:12.059284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-07T04:46:48.599598Z","title":"Robust autonomy emerges from self-play,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09800","last_updated":"2025-06-11T14:42:11Z","snapshot_observed_at":"2026-08-17T02:00:22.538905Z","submitted_at":"2025-06-11T14:42:11Z","title":"Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:46:48.599598Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2506.09800"},"observation_digest":"sha256:8b2ff256e6482c7e894f610580528ef6251ed6e068cda55d11648e1b439d79da","observation_id":"10e5fbc3-e30a-4a61-9136-346a2b2fdfad","resolution":{"observed_at":"2026-08-07T04:46:48.599598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2506.09981","last_updated":"2026-04-28T09:28:14Z","snapshot_observed_at":"2026-08-12T13:07:02.048020Z","submitted_at":"2025-06-11T17:55:05Z","title":"ReSim: Reliable World Simulation for Autonomous Driving","version":2},"reference_index":122,"source":"pdf_text","source_observed_at":"2026-05-19T09:28:00.597160Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2506.09981"},"observation_digest":"sha256:84718fb479fe2d5c61535f8c6beb2e268956e1149adae3c04c01ff378ab137d6","observation_id":"ff55e5b3-f230-4397-8a20-57ca98e3f08f","resolution":{"observed_at":"2026-05-19T09:32:16.639793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-15T19:15:25.299216Z","title":"Robust autonomy emerges from self-play","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17213","last_updated":"2025-08-05T07:06:16Z","snapshot_observed_at":"2026-08-19T03:17:27.591175Z","submitted_at":"2025-06-20T17:59:21Z","title":"Long-term Traffic Simulation with Interleaved Autoregressive Motion and Scenario Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:15:25.299216Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2506.17213"},"observation_digest":"sha256:38626363f9025c6dea3e5be34965edfe94b4fc9284c76b6c4ba065dd14916437","observation_id":"a77c0a0b-3c20-429b-a4f1-ba3465a6445f","resolution":{"observed_at":"2026-08-15T19:15:25.299216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T11:30:39.719000Z","title":"Cusumano-Towner, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02754","last_updated":"2025-09-02T19:02:49Z","snapshot_observed_at":"2026-08-17T12:14:51.380012Z","submitted_at":"2025-09-02T19:02:49Z","title":"Do LLM Modules Generalize? A Study on Motion Generation for Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:30:39.719000Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2509.02754"},"observation_digest":"sha256:b60d14cba5d62bb89ab46327b9953ae6e1f17b60cc037f950db45de2e5a3e910","observation_id":"465aad7e-8b2d-4b01-8aac-a190d7c6edc4","resolution":{"observed_at":"2026-08-05T11:30:39.719000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T11:30:39.785533Z","title":"Cusumano-Towner, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02754","last_updated":"2025-09-02T19:02:49Z","snapshot_observed_at":"2026-08-17T12:14:51.380012Z","submitted_at":"2025-09-02T19:02:49Z","title":"Do LLM Modules Generalize? A Study on Motion Generation for Autonomous Driving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T11:30:39.785533Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2509.02754"},"observation_digest":"sha256:d2c14ce26750148a5d606b06ca3c62b3b04bb163c19c69562465bc2610b4135e","observation_id":"dd036bb1-edd3-4b43-a406-918dbef118f8","resolution":{"observed_at":"2026-08-05T11:30:39.785533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-04T07:54:30.759844Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.24108","last_updated":"2026-07-08T06:19:04Z","snapshot_observed_at":"2026-08-14T22:15:17.088325Z","submitted_at":"2025-10-28T06:26:36Z","title":"Zero-Human Demonstration End-to-end Autonomous Driving with Trajectory Scorer","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T07:54:30.759844Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2510.24108"},"observation_digest":"sha256:cbaf2cbece82173f09158568fa7c0b863ea2d47ed86fc288ed11cbe0dd6a1e82","observation_id":"a83e19fe-3e0e-4029-9efd-23a47a025ff1","resolution":{"observed_at":"2026-08-04T07:54:30.759844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2511.23369","last_updated":"2026-04-10T09:10:11Z","snapshot_observed_at":"2026-08-11T13:45:57.249010Z","submitted_at":"2025-11-28T17:17:38Z","title":"SimScale: Learning to Drive via Real-World Simulation at Scale","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T04:33:03.629533Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2511.23369"},"observation_digest":"sha256:2336b12cf9ee41ec6331bcf8fd3d4c8d2506415fbe633a148a8e66d021516e2a","observation_id":"0b292628-4c79-4062-89ff-98aba0300a7a","resolution":{"observed_at":"2026-05-17T04:34:01.801151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2512.05812","last_updated":"2026-04-13T20:38:47Z","snapshot_observed_at":"2026-08-15T09:02:03.904362Z","submitted_at":"2025-12-05T15:32:36Z","title":"Toward Efficient and Robust Behavior Models for Multi-Agent Driving Simulation","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T00:58:51.811689Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2512.05812"},"observation_digest":"sha256:93a0e5f19b06a7dd931943f209c6bb2acf0370a17bd596bce281ff53fe280e6a","observation_id":"48f2fab1-111f-4781-8bc5-41e4693a69a1","resolution":{"observed_at":"2026-05-17T01:01:24.381990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2512.18662","last_updated":"2026-04-09T10:12:22Z","snapshot_observed_at":"2026-08-13T10:43:08.229302Z","submitted_at":"2025-12-21T09:21:04Z","title":"Pseudo-Expert Regularized Offline RL for End-to-End Autonomous Driving in Photorealistic Closed-Loop Environments","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T20:45:30.382235Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2512.18662"},"observation_digest":"sha256:86ae5f7589629f7c2a9c7925ad68975107f0fed76a7efc830bb356082e01d3a3","observation_id":"8d07f791-8d78-44ee-ac19-7839504b674b","resolution":{"observed_at":"2026-05-16T20:48:32.670260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2603.24155","last_updated":"2026-04-07T08:33:33Z","snapshot_observed_at":"2026-08-16T12:23:53.270435Z","submitted_at":"2026-03-25T10:24:16Z","title":"Goal-Oriented Reactive Simulation for Closed-Loop Trajectory Prediction","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T00:55:01.446865Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2603.24155"},"observation_digest":"sha256:428809d20727983cc2be8c12a4cfdc4fd4278cfdf4ed64426238fbbbc29a858e","observation_id":"34b42deb-fcd3-4d6f-a907-b5cf663ef41b","resolution":{"observed_at":"2026-05-15T00:58:26.236918Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2604.08535","last_updated":"2026-04-09T17:59:18Z","snapshot_observed_at":"2026-08-18T16:22:10.685441Z","submitted_at":"2026-04-09T17:59:18Z","title":"Fail2Drive: Benchmarking Closed-Loop Driving Generalization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:01.704384Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2604.08535"},"observation_digest":"sha256:15faae2944e91fb4cb24ad84e5824eba49a82e618c4d225465adb89b644cea63","observation_id":"36c708b8-8da3-4d96-a343-ca6193000eda","resolution":{"observed_at":"2026-05-11T07:06:00.614667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2604.12857","last_updated":"2026-04-14T15:09:07Z","snapshot_observed_at":"2026-08-15T05:11:04.414295Z","submitted_at":"2026-04-14T15:09:07Z","title":"Artificial Intelligence for Modeling and Simulation of Mixed Automated and Human Traffic","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-10T16:00:59.662003Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2604.12857"},"observation_digest":"sha256:8f442576d23266924f1e84d87bf809efcd683135527f47523679448c0b4bdbe9","observation_id":"00dd2f59-8b17-49e0-bc5c-22d13bee7b60","resolution":{"observed_at":"2026-05-11T09:26:02.355386Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2604.27162","last_updated":"2026-04-29T20:09:13Z","snapshot_observed_at":"2026-08-13T08:27:55.370720Z","submitted_at":"2026-04-29T20:09:13Z","title":"A High-Throughput Compute-Efficient POMDP Hide-And-Seek-Engine (HASE) for Multi-Agent Operations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T10:27:55.337253Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2604.27162"},"observation_digest":"sha256:03f78e2499286b3ad0bbd9d0a9f92f20e43dbdfef92bc5ce9154263b64ed3663","observation_id":"a82d4539-80ce-4b82-9ab5-8fd6a6737eea","resolution":{"observed_at":"2026-05-12T09:36:26.174818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2605.09153","last_updated":"2026-05-09T20:31:34Z","snapshot_observed_at":"2026-08-11T11:03:45.546190Z","submitted_at":"2026-05-09T20:31:34Z","title":"Beyond Self-Play: Hierarchical Reasoning for Continuous Motion in Closed-Loop Traffic Simulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T01:55:14.466724Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2605.09153"},"observation_digest":"sha256:21eecdc5c06b603d1da3eda797151884255c0a5d468905d27833f7f033342575","observation_id":"8b6896ce-6007-417b-b44f-ea1ff0f21a0a","resolution":{"observed_at":"2026-05-12T01:56:14.768801Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2606.17386","last_updated":"2026-07-15T20:07:32Z","snapshot_observed_at":"2026-08-13T10:07:52.422499Z","submitted_at":"2026-06-16T00:45:01Z","title":"TerraTransfer: Learning End-to-End Driving Policies Without Expert Demonstrations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T02:27:51.946679Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.17386"},"observation_digest":"sha256:92f11f90e772a718d91165296402873703552b7d0218c11a47c82f8a407d0a12","observation_id":"4c5e5b1a-1677-40ad-a51f-428cb3753b4b","resolution":{"observed_at":"2026-07-03T18:38:49.981009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-02T11:08:36.440196Z","title":"Cusumano-Towner, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17386","last_updated":"2026-07-15T20:07:32Z","snapshot_observed_at":"2026-08-13T10:07:52.422499Z","submitted_at":"2026-06-16T00:45:01Z","title":"TerraTransfer: Learning End-to-End Driving Policies Without Expert Demonstrations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T11:08:36.440196Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.17386"},"observation_digest":"sha256:3d0303db729e998d7dec8c3068ffce5f56453fd14768118deffa92b03d7848d4","observation_id":"c9834175-3cba-4559-963f-fd1af52c1532","resolution":{"observed_at":"2026-08-02T11:08:36.440196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-18T04:32:07.554344Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:ee25b8991e4d17447ef986bb53694c0c5fe20df9a02a35a3c47ad8421f593875","observation_id":"6860ca74-a2ef-4fba-a27f-a32fd183fdf0","resolution":{"observed_at":"2026-07-03T14:28:31.997601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2606.25127","last_updated":"2026-06-23T20:02:51Z","snapshot_observed_at":"2026-08-14T07:25:49.672471Z","submitted_at":"2026-06-23T20:02:51Z","title":"Reward-Conditioned Attention: How Reward Design Shapes What Autonomous Driving Agents See","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-25T23:57:34.962907Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.25127"},"observation_digest":"sha256:6ec9bd3bdbbaffc7d07aaafe83987fed212db22713c32ad4f1f1b4bc7bb0d8c4","observation_id":"e1586130-8cf0-4e99-baa7-5925c3bd030b","resolution":{"observed_at":"2026-07-04T17:09:58.515865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2606.25280","last_updated":"2026-06-24T01:32:24Z","snapshot_observed_at":"2026-08-17T14:38:14.650648Z","submitted_at":"2026-06-24T01:32:24Z","title":"EvoFlock: evolved inverse design of multi-agent motion","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-25T19:54:26.458543Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.25280"},"observation_digest":"sha256:b7706dd497a09906f180ff4d89811aad9c08adf0892f0151f0d87f7c02516ef1","observation_id":"af1a91b1-d965-4fd1-b8cc-c41be498a61f","resolution":{"observed_at":"2026-06-25T19:58:18.375526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T15:25:40.157105Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-18T16:50:46.109145Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":188,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:40.157105Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:ebd5f50807e6524c70359d0a2b69fd628b5c61ac69fae8824cd63a82a821bc28","observation_id":"dccaaadd-7715-4fd8-a161-d1a2e932297b","resolution":{"observed_at":"2026-08-05T15:25:40.157105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03349/citation-record","integrity":"/paper/2502.03349/integrity","json":"/paper/2502.03349/citation-record.json","paper":"/paper/2502.03349"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:31.280463Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.280463Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:dc6b4e32a94fbd13988cd104f618a2ff4ff8511cc2b24fe20d6dfa4db41da0fb","observation_id":"c560996d-532e-4dfa-9a22-f531aa64e2e3","resolution":{"observed_at":"2026-08-09T05:08:31.280463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.299777Z","title":"PyTorch 2 : Faster machine learning through dynamic python bytecode transformation and graph compilation","venue":null,"work_id":"a0203540-a8db-4aa2-aa93-0fce1e132699","year":2024},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.288911Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:135b841c40df8b931fc831fba5abe9e18717afeefb385b7e8486454efb24da62","observation_id":"bc938c67-d263-409a-84ff-2964299347bb","resolution":{"observed_at":"2026-08-09T05:08:37.304921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-08-13T14:13:07.807518Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-09T05:08:31.300900Z","title":"P., Raiman, J., Salimans, T., Schlatter, J., Schneider, J., Sidor, S., Sutskever, I., Tang, J., Wolski, F., and Zhang, S","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.300900Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:ca9ed933c2eb31b035a7608ccee09c003d636ad832b9dbd2bb674b33c735613f","observation_id":"d2da4e02-6da2-47cc-a3ff-e13254fa9dc0","resolution":{"observed_at":"2026-08-09T05:08:31.300900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:31.307317Z","title":"and Sandholm, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.307317Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:53eab98910dd4afd0c30851e8dbe14db5b989054926e6ce847f972763c540403","observation_id":"d57ff388-c54f-4f81-83a9-cbdd7f4f6e71","resolution":{"observed_at":"2026-08-09T05:08:31.307317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.281100Z","title":"H., Vora, S., Liong, V","venue":null,"work_id":"e96f652b-d27e-41a0-8811-7a0bfb747c89","year":2020},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.316655Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:a3816d8de86f035f56d43bcbaf794a164be645ed8591aabe672b876c5e276159","observation_id":"a2cbb4db-98b9-4960-bde6-656b0acaecf1","resolution":{"observed_at":"2026-08-09T05:08:37.287964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11810","last_updated":"2022-02-04T02:50:02Z","snapshot_observed_at":"2026-08-13T09:27:32.843417Z","submitted_at":"2021-06-22T14:24:55Z","title":"NuPlan: A closed-loop ML-based planning benchmark for autonomous vehicles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11810","snapshot_observed_at":"2026-08-09T05:08:31.322144Z","title":"S., Fong, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.322144Z"},"links":{"cited_paper":"/paper/2106.11810","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:18cb9046534e903129c21f9a4807a9858cfa830e014044e749f74e0db2ec248f","observation_id":"4fc03a67-4b04-4823-adc6-d38e1115946c","resolution":{"observed_at":"2026-08-09T05:08:31.322144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.208787Z","title":"MP3 : A unified model to map, perceive, predict and plan","venue":null,"work_id":"05a249f7-5575-44a6-8e1e-ca7c6f3a0819","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.327925Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:a729933e57a9f17462c10e10eb24762d09f18a6ccffeab032334ebd44dcecaaf","observation_id":"f38f5efc-e40f-4542-ae90-d7c37106e588","resolution":{"observed_at":"2026-08-09T05:08:37.230258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.191959Z","title":"a henb \\","venue":null,"work_id":"13047ce9-11dd-4be6-be92-4d1b014c056a","year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.335494Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:5148797d5df751fff878946c853bb4fc2bacae35b9b46ebd679347133da371aa","observation_id":"5135be55-04ea-4c97-9b18-634343eaf5b0","resolution":{"observed_at":"2026-08-09T05:08:37.197066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16927","last_updated":"2024-08-15T13:55:30Z","snapshot_observed_at":"2026-08-18T17:48:53.031752Z","submitted_at":"2023-06-29T14:17:24Z","title":"End-to-end Autonomous Driving: Challenges and Frontiers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16927","snapshot_observed_at":"2026-08-09T05:08:31.344975Z","title":"End-to-end autonomous driving: Challenges and frontiers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.344975Z"},"links":{"cited_paper":"/paper/2306.16927","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:ec534a2fc7103390308fa8ca115062b310261c8218b03697a396ebf713d5d844","observation_id":"979f5309-117a-4e10-a3cc-7d0547270b34","resolution":{"observed_at":"2026-08-09T05:08:31.344975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.132823Z","title":"TransFuser : Imitation with transformer-based sensor fusion for autonomous driving","venue":null,"work_id":"57701993-8f5f-4256-a814-22c76db4dc0e","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.430170Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:7193f3ea5704d9ab208145e3237d38d2a81b0f2065cfea27a3bd0deef0ed6c4e","observation_id":"f6390ece-7529-405a-bca8-7de7c3567bd4","resolution":{"observed_at":"2026-08-09T05:08:37.178189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.069487Z","title":"Parting with misconceptions about learning-based vehicle motion planning","venue":null,"work_id":"ad6b8f9b-3704-4185-955b-8c977a9d3739","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.489514Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:2a58be6f7a7f85161c05ed33fc45cbf34ecf04c24c9e1a87f49e2fb139f9edc0","observation_id":"d4b7e2e8-011f-4a45-900b-f441fd3c00d2","resolution":{"observed_at":"2026-08-09T05:08:37.075055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:37.050470Z","title":null,"venue":null,"work_id":"946895d8-49b1-4f39-9595-15aab5f70c1e","year":1959},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.562737Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:c912cdb2502dd1b3e495f2293f4be1c3fed6e213d1bca7ad993205f39b65cd5d","observation_id":"64c7d806-2ca5-48b9-9130-4f7da7271df4","resolution":{"observed_at":"2026-08-09T05:08:37.057545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.915980Z","title":"and Koltun, V","venue":null,"work_id":"0d2d3e79-3eb3-4aca-adac-16a4f64ea39e","year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.662951Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:4fc8be034ab0aaa051040563200e5838a175954d390f864d31fb72b5ca55bbfe","observation_id":"b7db3ee7-d395-47ed-a420-e83738cb4532","resolution":{"observed_at":"2026-08-09T05:08:36.998204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.850239Z","title":"M., and Koltun, V","venue":null,"work_id":"d6288303-3351-4207-acb4-c77a2fe60fbb","year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.760252Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:c6e584b45a4d4050a56c9b2fc45148ee779159aa2321707d86c863bff9667c81","observation_id":"02d02b73-ce5c-4b52-ad87-38fddd4028be","resolution":{"observed_at":"2026-08-09T05:08:36.855683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T05:08:31.765716Z","title":"The Llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.765716Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:02e01df9677df9ea9e9d5a6aadb06f30144f1b3c635208d4eea22b8bc8cd74e8","observation_id":"1742629c-563e-43f3-bb73-3bbf3f6e444b","resolution":{"observed_at":"2026-08-09T05:08:31.765716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.833330Z","title":"R., Zhou, Y., Yang, Z., Chouard, A., Sun, P., Ngiam, J., Vasudevan, V., McCauley, A., Shlens, J., and Anguelov, D","venue":null,"work_id":"61483f4c-30d5-4261-8b0a-85c517c5ead3","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.770999Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:520520287163821df2487f1f87a540940b0029ef0a215aa532049723d0629383","observation_id":"d6be0833-dff3-4506-b24a-b71665e5f733","resolution":{"observed_at":"2026-08-09T05:08:36.839015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:31.775962Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.775962Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:ccc46d937c46c5dd5ad521d0eeab97cec4e42be9add71b45eff30b686e39620d","observation_id":"7301a986-253a-4e1c-ba90-947469b7d0ef","resolution":{"observed_at":"2026-08-09T05:08:31.775962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7302/8636","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Establishing a crash rate benchmark using large-scale naturalistic human ridehail data","venue":"Deep Blue (University of Michigan)","work_id":"93ed6630-a815-4b0a-8f4d-47d248c6bc76","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.780939Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:9459345336182e4dcb01b21ac533b402e614dc07f4ac6c92f8c40dc25f87c4af","observation_id":"7c3e9edf-ee13-4ffe-b4af-ac859ba159d2","resolution":{"observed_at":"2026-08-09T05:08:33.219886Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.816426Z","title":"D., Frey, E., Raichuk, A., Girgin, S., Mordatch, I., and Bachem, O","venue":null,"work_id":"45a836a4-1c69-42ad-9e5e-bff52cca4d79","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.787321Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:bd71fbc120a67b5c13382a73165cdd31134fd9e4985c7d4ac96df774fa3274ef","observation_id":"adb09096-11da-4dab-9ffc-b2af6d3ac3a1","resolution":{"observed_at":"2026-08-09T05:08:36.821983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.800125Z","title":"L., and Baxter, J","venue":null,"work_id":"32a02cda-9370-4952-bc60-2f6e3f6ce671","year":2004},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.792592Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:bdd371e9d01ba33acfaa9cb2b9c840ec12910d0500a360cc8d49ac459fe8b95d","observation_id":"9b209c5e-15b2-4520-8f06-d315c231556b","resolution":{"observed_at":"2026-08-09T05:08:36.805844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.773734Z","title":"D., Agarwal, R., Roelofs, R., Lu, Y., Montali, N., Mougin, P., Yang, Z., White, B., Faust, A., McAllister, R., Anguelov, D., and Sapp, B","venue":null,"work_id":"bc8de33d-d99c-4f14-8317-fdb8ea2897ad","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.798825Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:06605e047621d390abe7fc0461062e68c63e73b7dd6403872ec5dccf5172a7d4","observation_id":"69322343-643a-40bb-9239-144990206207","resolution":{"observed_at":"2026-08-09T05:08:36.785332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15736","last_updated":"2023-11-27T11:39:27Z","snapshot_observed_at":"2026-08-17T15:19:13.810244Z","submitted_at":"2023-11-27T11:39:27Z","title":"SceneDM: Scene-level Multi-agent Trajectory Generation with Consistent Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15736","snapshot_observed_at":"2026-08-09T05:08:31.803663Z","title":"Scene DM : S cene-level multi-agent trajectory generation with consistent diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.803663Z"},"links":{"cited_paper":"/paper/2311.15736","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:86f2e7a1c802fe601604bdad87504f3c3aee8e26b11a192a9d4455e8d4a53069","observation_id":"2e30f332-cac3-41e4-84d9-85a71342b334","resolution":{"observed_at":"2026-08-09T05:08:31.803663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.582417Z","title":"From prediction to planning with goal conditioned lane graph traversals","venue":null,"work_id":"3fdc2c42-60ad-47bc-b901-df0dcc5fabd8","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.808533Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:ed3aac2fae1ea80da8c5826b86f38a0c9d0914286ebd317d1725a69b908348a7","observation_id":"1a1ccbed-5cb6-43a3-87fe-800073ea520d","resolution":{"observed_at":"2026-08-09T05:08:34.697741Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.656588Z","title":"A., Bernstein, D","venue":null,"work_id":"bb04e801-b2be-4472-af10-1d6d9fc3c427","year":2004},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.813694Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:c10b163f1bccab0d6800226ec12891627e4bdc54255afb37b0d749fc44ce7f28","observation_id":"1beda1b5-a086-4ae8-93e3-3653f3563a4a","resolution":{"observed_at":"2026-08-09T05:08:36.763465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05805","last_updated":"2021-08-12T15:37:30Z","snapshot_observed_at":"2026-08-16T18:03:35.377997Z","submitted_at":"2021-08-12T15:37:30Z","title":"Reimagining an autonomous vehicle","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05805","snapshot_observed_at":"2026-08-09T05:08:31.819460Z","title":"Reimagining an autonomous vehicle, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.819460Z"},"links":{"cited_paper":"/paper/2108.05805","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:f928f492bba5b1669164ba4dd7730e62b4aeacc0848f2712d3c45454285a61dd","observation_id":"98a6f3ff-2d90-41f8-aa2f-1b030b972d20","resolution":{"observed_at":"2026-08-09T05:08:31.819460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-09T05:08:31.824252Z","title":"GAIA-1 : A generative world model for autonomous driving, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.824252Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:07baa7abfd40d40b00d5866bbde763e5a8b2f522ff27f5956b8dad34b02c89e7","observation_id":"d822a172-e9fa-49d7-ab85-d45f95de21dc","resolution":{"observed_at":"2026-08-09T05:08:31.824252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:31.860092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.860092Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:f396c9a72390b9afdd9016d8883cfffa8c12f2d26c05a2d5aba08c586cab5925","observation_id":"6523d3fe-7f3d-4149-ab23-edbc1ed4a575","resolution":{"observed_at":"2026-08-09T05:08:31.860092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.144024Z","title":"and Pavone, M","venue":null,"work_id":"c689b288-d43e-4fba-8909-66be1fd41c96","year":2019},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.901651Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:643681ec9ed3fc55203bf9c4132df2f3831d24dcb44bbf281e5d68c9bb9a97d2","observation_id":"a6cd2b5e-eb20-4354-adf0-421726636f69","resolution":{"observed_at":"2026-08-09T05:08:34.150562Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09846","last_updated":"2017-11-28T16:16:21Z","snapshot_observed_at":"2026-08-15T05:47:29.683783Z","submitted_at":"2017-11-27T17:33:27Z","title":"Population Based Training of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09846","snapshot_observed_at":"2026-08-09T05:08:31.941551Z","title":"M., Donahue, J., Razavi, A., Vinyals, O., Green, T., Dunning, I., Simonyan, K., Fernando, C., and Kavukcuoglu, K","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:31.941551Z"},"links":{"cited_paper":"/paper/1711.09846","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:82459b2a705247bcd5e14ec6f587dec767db88589305afe741c6974c58b32d1d","observation_id":"2adf9542-c9af-4021-8e89-d2891c9df044","resolution":{"observed_at":"2026-08-09T05:08:31.941551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.057143Z","title":"M., Dunning, I., Marris, L., Lever, G., Castañeda, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.057143Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:6963c5b4c0e7fa57b55de8bc7def4138b9f48d0ba00ddf762c8d3225d958fc6c","observation_id":"03b86e64-be43-4188-9054-c9ef0b664f03","resolution":{"observed_at":"2026-08-09T05:08:32.057143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.517005Z","title":"Hidden biases of end-to-end driving models","venue":null,"work_id":"3767cd48-2c50-4ca7-a6ca-2aa3fb092f44","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.104948Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:5dda53e044f779373d74bd9654fd3e28c8165025013a91bfc66ecf7ca4a3f6e0","observation_id":"911f755b-7d74-4189-926e-bac5b0d6d35a","resolution":{"observed_at":"2026-08-09T05:08:36.570025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08142","last_updated":"2021-08-09T16:51:06Z","snapshot_observed_at":"2026-08-16T18:09:26.163507Z","submitted_at":"2021-07-16T23:20:26Z","title":"Autonomy 2.0: Why is self-driving always 5 years away?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08142","snapshot_observed_at":"2026-08-09T05:08:32.144768Z","title":"D., Grimmett, H., and Ondruska, P","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.144768Z"},"links":{"cited_paper":"/paper/2107.08142","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:81e2e6a039ea10a80a3400634b2ebebde5fb169e06f5decdc2e7e1d190896c57","observation_id":"70b12475-9228-4962-8074-2b3e9e245365","resolution":{"observed_at":"2026-08-09T05:08:32.144768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.391491Z","title":"Champion-level drone racing using deep reinforcement learning","venue":null,"work_id":"64647866-107d-4aff-853b-576650fae049","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.162560Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:e523441c5154d3d50f104d95caeed7bb0a36464a26ff6a38081d1040615fd66f","observation_id":"8dac1b9b-b608-42eb-b7fa-be8b07b672a2","resolution":{"observed_at":"2026-08-09T05:08:36.470284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.333482Z","title":"General lane-changing model mobil for car-following models","venue":null,"work_id":"ffbf9117-2420-4aee-bbf6-8b0172fb9ee5","year":1999},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.168744Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:9ae1460aef5204a9351784a1f62cb3d69295a85fee42e2adf590ec702a74d67f","observation_id":"ca8ef44d-86ef-4ec5-92d3-fe2c2218987a","resolution":{"observed_at":"2026-08-09T05:08:36.339360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.313641Z","title":"Enhanced intelligent driver model to access the impact of driving strategies on traffic capacity","venue":null,"work_id":"f481d7a9-c3ba-45c9-a093-702f088b0498","year":2010},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.175264Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:20ed525364479abbceafeb35511076772436b445c989c3b7e5b3509628ae6478","observation_id":"f8059699-dc48-4ac2-af47-0d5f04a34666","resolution":{"observed_at":"2026-08-09T05:08:36.320111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T05:08:32.184692Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.184692Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:595673a07c0ec90d8302ef19fb16424b127427b936d14be3d988802f2d887e2d","observation_id":"278f60fc-900d-49b2-9391-1c14f31608bd","resolution":{"observed_at":"2026-08-09T05:08:32.184692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.296996Z","title":"Learning quadrupedal locomotion over challenging terrain","venue":null,"work_id":"d0903316-f42f-442e-a8cf-1a284afd04b3","year":2020},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.190340Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:726c1b923a29c7c6303e9acee42ac7f010e59a32f871ec630911d69b139314a0","observation_id":"ef899268-aa00-41da-a4c5-39f6b246efb8","resolution":{"observed_at":"2026-08-09T05:08:36.302113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:33.916966Z","title":"Metadrive: Composing diverse driving scenarios for generalizable reinforcement learning","venue":null,"work_id":"faa8dd04-d3b4-485b-9ed9-6c5f54f2787a","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.195248Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:32f4a094352ab5d103dd19fe6a0c1fa111354ed47e91c457f7add23daa739c24","observation_id":"743119ef-d968-4b2e-99fc-9e82467ed1e7","resolution":{"observed_at":"2026-08-09T05:08:33.931627Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:33.567676Z","title":"Imitation is not enough: Robustifying imitation with reinforcement learning for challenging driving scenarios","venue":null,"work_id":"9242f310-5e49-477c-a4a6-1a6c3804b711","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.200506Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:4fe9dc051b4435ac36e8b73e047d2c47a86268596dd6a70b835d2a45d25a90c7","observation_id":"47277fe1-4ab4-4e40-86f2-258a9b9e00ed","resolution":{"observed_at":"2026-08-09T05:08:33.617331Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.277043Z","title":"Isaac gym: High performance GPU based physics simulation for robot learning","venue":null,"work_id":"cbadb825-ae3e-40a9-8e70-06f62f5f38d5","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.206460Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:dc3e95486e1c21f78fb0c8851d63239679aff07edec28e94dbb6a37ba4e4ded7","observation_id":"43c8fe92-ee9d-42f4-a0f2-203352bc3f32","resolution":{"observed_at":"2026-08-09T05:08:36.283094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.257133Z","title":"Z., Whiteson, S., White, B., and Anguelov, D","venue":null,"work_id":"1281ac46-e947-4061-9625-a5c390383ee6","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.238463Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:658ee2c2bc1e02b2bdab22436175a0ffab3a3b2ec9942a04ec14c310084c2217","observation_id":"5712b127-e18f-45f5-9ba3-a1e59141203b","resolution":{"observed_at":"2026-08-09T05:08:36.262953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.237377Z","title":"Driving policy transfer via modularity and abstraction","venue":null,"work_id":"a182696c-6859-4dbb-8cd7-5aeab941a233","year":2018},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.245689Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:42e318bd0019a7c6e5764f63a9f74c637cd6aaa8f18918fe50bcecbf9282038c","observation_id":"bd217bb1-d4d5-4626-9807-68132cad3ce6","resolution":{"observed_at":"2026-08-09T05:08:36.243432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:36.131336Z","title":"D., and Yanagisawa, M","venue":null,"work_id":"cc9dd737-92e1-4675-bef6-0796dc9ec49a","year":2007},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.251134Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:e592ca5ae09e779c90f0fc1e97be3670a10a04046c297662e1ea0b8ffe39f741","observation_id":"419a879a-8999-48b1-97b1-40896a3a6a78","resolution":{"observed_at":"2026-08-09T05:08:36.224796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.994394Z","title":"S., and Sapp, B","venue":null,"work_id":"18501038-0e85-4159-916c-8155ace67582","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.255968Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:2f852d1252f824077e18e089d4428c6c4f98c9d207e889c1eb1e5432477553fa","observation_id":"c076c960-2818-44fc-ad46-961bdbde9f3e","resolution":{"observed_at":"2026-08-09T05:08:36.073939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.852363Z","title":"Neural scene graphs for dynamic scenes","venue":null,"work_id":"1f6581f1-b32f-4abf-9296-f0cb3955afa8","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.262086Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:c9eea6ff751a490da94966d4d5b85140a26bcc35d0ccc03555c06a359ca12a80","observation_id":"0b2923a5-782c-4498-ac13-2dce5bd14bf8","resolution":{"observed_at":"2026-08-09T05:08:35.923307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.267490Z","title":"D., Hennes, D., Tarassov, E., Strub, F., de Boer, V., Muller, P., Connor, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.267490Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:74486b74cc365b51a7be6c304f0481bef2b172167974fca6f98532482d074b71","observation_id":"556fe3c0-92ce-4e07-8f9f-870612e84298","resolution":{"observed_at":"2026-08-09T05:08:32.267490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.825229Z","title":"Megaverse: Simulating embodied agents at one million experiences per second","venue":null,"work_id":"871bbc8e-3d14-4986-bc83-6f1e34f6899f","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.273152Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:53c12c3461bca4c2eeb38570628cfd740ddc0699403c9b7bfec0cba7ea791b10","observation_id":"313ef77b-7ea2-4d64-a713-652a6b113587","resolution":{"observed_at":"2026-08-09T05:08:35.830489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.810356Z","title":"PDexPBT : Scaling up dexterous manipulation for hand-arm systems with population based training","venue":null,"work_id":"4a09826f-391d-407d-bc73-8d3f21f41684","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.285725Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:446c6e4d3e63cd92c7bcaadfa78d2f86116ab9075f7831afc627d9d700e2a9d0","observation_id":"b156634d-56be-43cc-9511-8f87e69ab864","resolution":{"observed_at":"2026-08-09T05:08:35.814928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.795990Z","title":"B., and Fidler, S","venue":null,"work_id":"7679166c-d0a6-4575-ad49-953c1d405685","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.365954Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:02591f3502568c4d4aaa3a61a60469b00cf1ba53dd527b57f833ea55a4333575","observation_id":"2913390b-16b9-4245-8924-a9d0e6e2856f","resolution":{"observed_at":"2026-08-09T05:08:35.800133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.04882","last_updated":"2021-01-13T05:20:20Z","snapshot_observed_at":"2026-08-17T17:09:25.991939Z","submitted_at":"2021-01-13T05:20:20Z","title":"Asymmetric self-play for automatic goal discovery in robotic manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.04882","snapshot_observed_at":"2026-08-09T05:08:32.433492Z","title":"P., Paino, A., Noh, H., Weng, L., Yuan, Q., Chu, C., and Zaremba, W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.433492Z"},"links":{"cited_paper":"/paper/2101.04882","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:38f1b81775f21c9f9e5c3437003b8f3ccaef5ef7e1f7107e0ec806af7ae5dc81","observation_id":"13adea34-0abd-4ef1-935a-8da5468ed2d9","resolution":{"observed_at":"2026-08-09T05:08:32.433492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.779742Z","title":"A simple yet effective method for simulating realistic multi-agent behaviors","venue":null,"work_id":"0fd06e41-5b26-4c97-bef0-4240856f79e1","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.470788Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:4d9e56d42918ca6e636028fb966999e9271c7a7f307520033ec0ab61c8d7cd5d","observation_id":"86133d92-ea25-41bd-bcb2-3aadd043a929","resolution":{"observed_at":"2026-08-09T05:08:35.785118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.762914Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":"b0e981ba-e154-4592-998a-2aeac8daf223","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.514949Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:668201b5d3c682d12cece35d3b74ded7aefbc729a5d8cefb00463527cc96794a","observation_id":"4a590291-3890-46e9-8703-167f750dad8a","resolution":{"observed_at":"2026-08-09T05:08:35.768403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.746969Z","title":"S., Akata, Z., and Geiger, A","venue":null,"work_id":"baa6c573-1ca3-4d4d-986a-1e120f63248b","year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.556107Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:1e93170073167319a2172d1f42e30fb6e723be5407c94a3f511d3bb0e47f5d29","observation_id":"53975d24-fb29-4b31-b39e-1613ce43bfaa","resolution":{"observed_at":"2026-08-09T05:08:35.751815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.709452Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning","venue":null,"work_id":"2a214ca2-2076-4837-b22b-2a0e11dab4be","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.604900Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:32606bd2c2f852de5801244cdd325412d5dd02bd43e60894749f664eb7b6613c","observation_id":"4833ac4b-fac7-4e44-a69e-622ca3863320","resolution":{"observed_at":"2026-08-09T05:08:35.729327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.614825Z","title":"Prioritized experience replay","venue":null,"work_id":"38a2f066-4ea7-4e65-9a69-f9a8ad69d251","year":2016},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.609554Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:87474882b836f9c65db653400be05cc7f2321f7a8380f0e14ed50a2497af3a08","observation_id":"ce0d0d04-a84f-4348-aec5-c18be5763990","resolution":{"observed_at":"2026-08-09T05:08:35.698364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.413300Z","title":"Urban driver: Learning to drive from real-world demonstrations using policy gradients","venue":null,"work_id":"c277d6c1-ddc8-4f43-93d3-263721644d9c","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.613919Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:a85040ef502083893c35b36809b2eb8869ab4ae6de23e0094493f9cfd6aef286","observation_id":"16e4460a-caf9-475e-8332-fc5cb91c0da9","resolution":{"observed_at":"2026-08-09T05:08:35.481238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.396836Z","title":"I., and Abbeel, P","venue":null,"work_id":"261a1bff-3af9-4299-b68c-76ec5065eda3","year":2016},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.618526Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:d31d4f5ed50328259e7ebc8f56d88614e80b6465233ba99a6bd9c825cda77a6f","observation_id":"d893577c-fc7c-4482-b928-ce7b94a8332f","resolution":{"observed_at":"2026-08-09T05:08:35.402447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T05:08:32.623266Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.623266Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:7fa1036eb9ff5c1ab9f0a196d9add3441e769ec8a3c1d15314a7d5c0973d1fd3","observation_id":"c64ce62c-9ee7-41b2-9655-ab83c59b89b3","resolution":{"observed_at":"2026-08-09T05:08:32.623266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.377969Z","title":"Large batch simulation for deep reinforcement learning","venue":null,"work_id":"1b2b9b0e-ffbd-47d1-a9ca-94fe2b458737","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.628727Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:744089e41621b588b48bb87c33381092a5ba5bf0a042b04b424f4be0fba16191","observation_id":"68cfe68f-a755-457e-96a9-bf706128fd0b","resolution":{"observed_at":"2026-08-09T05:08:35.385229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.360597Z","title":"G., Xie, Z., Sarkar, B., Szot, A., Wijmans, E., Koltun, V., Batra, D., and Fatahalian, K","venue":null,"work_id":"8baf82a8-28f3-49df-8fd9-8a9858ad95e5","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.633421Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:54025715b65171c9423f6f607b46e8e1a8ac1bd78ba51ad5f221fafdb98bb147","observation_id":"890c8775-cd6d-4eca-ae57-d56e52a051ab","resolution":{"observed_at":"2026-08-09T05:08:35.366424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.342280Z","title":"Motion transformer with global intention localization and local movement refinement","venue":null,"work_id":"495090b8-58e3-45ca-b8ed-fd4bac4c9745","year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.638000Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:907f8aa3c572be3bd5d0283fd0fb2b1026d689f7640c84b09d3f27454c34f654","observation_id":"f5ab747f-b612-40c5-824b-38437f505a33","resolution":{"observed_at":"2026-08-09T05:08:35.347608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.642587Z","title":"P., Hui, F., Sifre, L., van den Driessche, G., Graepel, T., and Hassabis, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.642587Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:37c210abc0765298458b151bf9be00cd66a6f0ac42b5d57f5322274924cb1068","observation_id":"63ebb15c-ddd6-400a-bf9e-739cfa3bed2d","resolution":{"observed_at":"2026-08-09T05:08:32.642587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.647978Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and Go through self-play","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.647978Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:e29fef61a007e75e46dc1670f7e69c5a1b30f55471544a268527044cc1844bc0","observation_id":"32a976c8-3cd8-41af-9244-2a03b6b17b23","resolution":{"observed_at":"2026-08-09T05:08:32.647978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.317584Z","title":"Overview of motor vehicle traffic crashes in 2021","venue":null,"work_id":"a6bc3cdb-f819-4c14-b096-f4c6f8224001","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.653022Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:21a32f6e2f1d1031cf780c2ff6d9f65211c3c4031172005c23bab9e695615d97","observation_id":"da09e55e-097e-4b12-8edf-5693f2252bfe","resolution":{"observed_at":"2026-08-09T05:08:35.330293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.298831Z","title":"TrafficSim : Learning to simulate realistic multi-agent behaviors","venue":null,"work_id":"782b7d2d-fc6e-49c4-aa5d-0c0824c8dbd2","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.658574Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:2adf2ec79b6629381f97b37f6dcdfab641546658e1978d03bf1f9d87eddb1f2e","observation_id":"607780d5-162b-40ea-96c2-38a102ab9a93","resolution":{"observed_at":"2026-08-09T05:08:35.304392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.262783Z","title":"Repaint: Knowledge transfer in deep reinforcement learning","venue":null,"work_id":"98087488-d237-4520-b8c5-ef15cbd539d4","year":2021},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.663773Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:d9cf99ce85e4910418fd4771391460fea76cd2d69e4fe2b57b330c1aee42e86e","observation_id":"5a452fba-fc03-4af1-a85c-8ee22f5662f6","resolution":{"observed_at":"2026-08-09T05:08:35.275560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.669511Z","title":"Congested traffic states in empirical observations and microscopic simulations","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.669511Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:74efbab2e3bb48aa61268fa5b7a4f03b0281dfb190883240a071ddb1bee7a788","observation_id":"7c49851a-5ab6-451a-bc12-c6992396d76b","resolution":{"observed_at":"2026-08-09T05:08:32.669511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.070486Z","title":"Nocturne: a scalable driving benchmark for bringing multi-agent learning one step closer to the real world","venue":null,"work_id":"f42abd86-e430-4b88-a2e7-ab4eed4cdb1a","year":2022},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.674034Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:94d11c75ab08be6ce51cff2c861878a101f85e65082c6a23db6a845d4d351201","observation_id":"0ff84da0-9e2a-4710-8cc9-db24e3fa0e4c","resolution":{"observed_at":"2026-08-09T05:08:35.163734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:32.679149Z","title":"u l c ehre, C ., Wang, Z., Pfaff, T., Wu, Y., Ring, R., Yogatama, D., W \\","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.679149Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:e85dc04e255918f446e6ad8c146c9a9fe3649386839620d860ab6364b4d1a458","observation_id":"be7dfae8-de9a-4e6a-9126-dd2951eb45b9","resolution":{"observed_at":"2026-08-09T05:08:32.679149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.037760Z","title":"and Zhen, H","venue":null,"work_id":"8805b7ae-5483-48a9-9b68-c08daa3c423c","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.683801Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:64eab9a0d8c703e6ff7ea97485732cc064c2106ded79254ed4de55a095375ad3","observation_id":"11c8efa5-31dd-4716-989c-986ecf884f0f","resolution":{"observed_at":"2026-08-09T05:08:35.043471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:35.014452Z","title":"Self-play reinforcement learning guides protein engineering","venue":null,"work_id":"eedee971-3b75-4768-92e8-f1e102040f5c","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.715561Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:18e7b6709d705c4febcdb4f229ca363ffef756f81ca909ee97f95bc04cd5691e","observation_id":"ee420ee1-6631-4c52-b8a3-8d2e7ea42baf","resolution":{"observed_at":"2026-08-09T05:08:35.022127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11868","last_updated":"2023-06-20T20:01:07Z","snapshot_observed_at":"2026-08-16T15:22:24.816644Z","submitted_at":"2023-06-20T20:01:07Z","title":"Multiverse Transformer: 1st Place Solution for Waymo Open Sim Agents Challenge 2023","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11868","snapshot_observed_at":"2026-08-09T05:08:32.786796Z","title":"Multiverse transformer: 1st place solution for Waymo open sim agents challenge 2023, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.786796Z"},"links":{"cited_paper":"/paper/2306.11868","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:621e850c2971449a03154a97b292bbb3c730c92e6a8809a1027d7b393e41fdc1","observation_id":"01c17366-be68-4d96-8b93-5b0da930d68b","resolution":{"observed_at":"2026-08-09T05:08:32.786796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.992477Z","title":"DD-PPO: learning near-perfect pointgoal navigators from 2.5 billion frames","venue":null,"work_id":"afb6ce49-14e3-43a5-9182-7a865587e197","year":2020},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.836104Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:3ae801eaa25dc2aa6dcc84444947419707562a48f95d5ea6f373286d8c8ee36f","observation_id":"cd49ece2-1ad6-4d39-9754-093a3bd43bee","resolution":{"observed_at":"2026-08-09T05:08:35.001362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.970879Z","title":"Bits: Bi-level imitation for traffic simulation","venue":null,"work_id":"c493b950-3afa-4693-89f4-33a09e2d621e","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.916636Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:67dfa38a23861ba28462a7e1faeb367216d16fc0c970c150e1633ca33f0d0a48","observation_id":"d0dab807-a513-484c-90cd-39afce3b0573","resolution":{"observed_at":"2026-08-09T05:08:34.978009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06559","last_updated":"2024-07-16T15:54:22Z","snapshot_observed_at":"2026-08-20T11:33:47.738391Z","submitted_at":"2024-02-09T17:18:33Z","title":"Diffusion-ES: Gradient-free Planning with Diffusion for Autonomous Driving and Zero-Shot Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06559","snapshot_observed_at":"2026-08-09T05:08:32.980823Z","title":"Diffusion- ES : Gradient-free planning with diffusion for autonomous driving and zero-shot instruction following, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:32.980823Z"},"links":{"cited_paper":"/paper/2402.06559","citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:61aa7a84bc436210cc24005b0c43a97fef72607bcf33f0ed5a1f8d44c792a98d","observation_id":"af82bec9-6b07-4187-a4d1-a298dac05127","resolution":{"observed_at":"2026-08-09T05:08:32.980823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.953415Z","title":"J., and Urtasun, R","venue":null,"work_id":"88ae7281-b341-4ded-bb27-8fe5f9a7b07d","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:33.086473Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:e63e64bf1f92a9439a2ba98d6f2e0daf6b80c5c1252a3d1467553db5012d3f17","observation_id":"267c91bb-6aae-4230-affe-eec5fe8f101e","resolution":{"observed_at":"2026-08-09T05:08:34.958563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.934956Z","title":null,"venue":null,"work_id":"3c7cb0eb-54d6-4740-a8a5-e639ae79ee6a","year":2017},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:33.090791Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:83d572cbf90084af9eabd46a2ab9e5a818a15632ab68fac478bc2a92b2ac6611","observation_id":"a1c4d79b-43f8-42f8-9d07-6d4cc806eb3a","resolution":{"observed_at":"2026-08-09T05:08:34.941341Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.918710Z","title":"Learning realistic traffic agents in closed-loop","venue":null,"work_id":"812e5b95-858c-4726-a8c2-ffa2780df5c2","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:33.094973Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:63b253199ed43cb19517d52ca42795c556ba30ac22754a0f9533b17244b94c91","observation_id":"8f88b43a-8a67-4605-b079-c560bb1bc3b6","resolution":{"observed_at":"2026-08-09T05:08:34.924219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:08:34.862563Z","title":"Guided conditional diffusion for controllable traffic simulation","venue":null,"work_id":"2dff2d1b-bc28-4483-bc94-602c5d0394b2","year":2023},"citing_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-09T05:08:33.099836Z"},"links":{"citing_paper":"/paper/2502.03349"},"observation_digest":"sha256:83bae038e8058599931edac36be23c5f3eb05ee08b16e1c7e6a860a3de23b874","observation_id":"9c44ad32-e149-4f97-b62d-684951e89a01","resolution":{"observed_at":"2026-08-09T05:08:34.905940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":4,"verified_fuzzy":48},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 25 inbound Pith citation observations for arXiv:2502.03349."}