{"as_of":"2026-08-13T17:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fb27e0e882d713d3ca4279b6104b68236a8e8afff900b1e1f62d37f84c39876","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:51:56.870832Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03682/citation-record","integrity":"/paper/2509.03682/integrity","json":"/paper/2509.03682/citation-record.json","paper":"/paper/2509.03682"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.329704Z","title":"Video games remain America’s favorite pastime with more than 212 million Americans playing regularly,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.329704Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:546c522106b286f51bc70fcbac1bb532e788cb8c6ccbe69792568e46f9b50eb7","observation_id":"2e3dc315-d850-4fc2-820d-63b97b8903ad","resolution":{"observed_at":"2026-08-05T10:51:55.329704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.451538Z","title":"GVR-4-68038-527-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.451538Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:129dd91464fda523eeb30ada5d124f7c58e486192b7c7ebcb5b2d6eeee3678e3","observation_id":"4959a035-d10b-4c98-aa5d-b0791b2980a5","resolution":{"observed_at":"2026-08-05T10:51:55.451538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.630270Z","title":"2024 essential facts about the U.S. video game industry,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.630270Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:69ea7beab314e8377e5f39ed917e4c160d689ec9fc214d6ef93a96d3d2edeb8b","observation_id":"1a43f34c-6445-4bb8-8323-dd4baa3d197d","resolution":{"observed_at":"2026-08-05T10:51:55.630270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.356727Z","title":"A machine for playing the game Nim,","venue":null,"work_id":"d4ca7f64-114d-407c-b6a5-6b37dd2c0e5a","year":1948},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.633466Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:2eb6677aacb06ce65c992c834eb3f8cdb83a4dca53070ed36bbd21fe3815b6aa","observation_id":"e821a649-c194-490d-9def-fdce0bc1d069","resolution":{"observed_at":"2026-08-05T10:51:59.359580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.348468Z","title":"Understanding behavior trees,","venue":null,"work_id":"0bd7ba94-a339-4625-9dcc-712e699d894d","year":2007},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.636360Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d727e28a05cd146d3150f52476078b90db8edb00b2782e6b59220ca45bf0c1c9","observation_id":"e781a5bc-48fa-45b4-a7dd-9281d36801f8","resolution":{"observed_at":"2026-08-05T10:51:59.351339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.339824Z","title":null,"venue":null,"work_id":"8970fd2b-f340-4e8e-9e6d-ba9d61e557e2","year":1998},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.639194Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:9056791a0a7e60139f145561fc52a99309b4ebb7e2843944acd6a0e8a9292dd4","observation_id":"f00c2ad3-b3e5-46ff-959d-47db68b687d8","resolution":{"observed_at":"2026-08-05T10:51:59.342462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.331307Z","title":"Using reinforcement learning to solve AI control problems,","venue":null,"work_id":"e4742063-87cb-418d-815f-d1eed0a749aa","year":2004},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.642482Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e606f7dc38f6768c06c075410a7ae3da2ba99c4ef05fecc805100e4b89f50bf5","observation_id":"876ef60d-4a86-4e90-a489-90a9932bb23f","resolution":{"observed_at":"2026-08-05T10:51:59.334265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2011.60334","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.896519Z","title":"Connectionist reinforcement learning for intelligent unit micromanagement in StarCraft,","venue":null,"work_id":"347f444f-ecf5-44d6-90e4-31c7a9cb2870","year":2011},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.645303Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f204143b6761605c78a0fc58e87ca0c06d303425931b2ff49c54fa5d2a974232","observation_id":"afddbaf4-788d-4db8-a08b-a3c70c22b08d","resolution":{"observed_at":"2026-08-05T10:51:58.901174Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3652.34238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.819939Z","title":"Go with the flow: Reinforcement learning in turn-based battle video games,","venue":null,"work_id":"b4ce104e-832f-42a7-b3ce-78942d06ed65","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.648388Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:5a5671b8fa3d655839a918f4b9e268899f8e9744a1ac878bcb9a18df1af0627e","observation_id":"6b3fadd6-b650-4553-8264-1c341bba557f","resolution":{"observed_at":"2026-08-05T10:51:58.824503Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.322841Z","title":"A review of real -time strategy game AI,","venue":null,"work_id":"4d698b5c-b996-4b1b-8591-e3df4177c08b","year":2014},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.651337Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:bbbb5af7d89ad286960973185fa17afe32050d385b799dd87f79fb8c3d8e1fa0","observation_id":"a134d1bf-93f5-4246-a593-2e5bd04fcecd","resolution":{"observed_at":"2026-08-05T10:51:59.325659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.313923Z","title":"Human -level control th rough deep reinforcement learning,","venue":null,"work_id":"c847dec8-dd7b-48be-9886-605bcc1005f9","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.653948Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c6032047d04112d1538e91b1457f1800b46e8502e4f26dbd5856ff0be3489194","observation_id":"6979e9ac-d099-467c-8fc0-7f161b3142e1","resolution":{"observed_at":"2026-08-05T10:51:59.316847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v31i1.10827","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Playing FPS games with deep reinforcement learning,","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"75903f1b-7633-40ec-8bbe-4c15e663d844","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.656727Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b30143243492f92ffa67a10c103291ddc5725b804e0e820247cb2232b3bc1494","observation_id":"24580eec-7934-4082-a9ce-fa355c2ea402","resolution":{"observed_at":"2026-08-05T10:51:56.932869Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2021/294","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Deep reinforcement learning for navigation in AAA video games,","venue":null,"work_id":"8aaf8b10-6986-4100-a988-4be5b1baea48","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.659201Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3ebdc3152cc7ca3429cc46a0868e46382e6b304442f12dfeb06f335915c853c0","observation_id":"42a572b5-4734-4521-aef1-a8900594b2fc","resolution":{"observed_at":"2026-08-05T10:51:56.923422Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.305923Z","title":null,"venue":null,"work_id":"b20be821-a966-4369-86ce-191ae035508c","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.661751Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:52f4e86b5d3cb930b87852991800226572dcc5f9234c110dc5ccdf91ac632b79","observation_id":"a98459be-091b-4357-911d-0ce793105003","resolution":{"observed_at":"2026-08-05T10:51:59.308553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.297001Z","title":"Mastering Atari, Go, chess and shogi by planning with a learned model,","venue":null,"work_id":"f86013da-df08-42d2-8844-063bedc91926","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.664123Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:9a9100764f1e47caeacd303acd762cb220e9d3a9721f6e1b116478de79cb48d9","observation_id":"96f95acf-8b31-4010-9a16-ee6f6d426171","resolution":{"observed_at":"2026-08-05T10:51:59.300124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06449","last_updated":"2021-11-11T20:31:19Z","snapshot_observed_at":"2026-08-13T17:35:19.823453Z","submitted_at":"2021-11-11T20:31:19Z","title":"Expert Human-Level Driving in Gran Turismo Sport Using Deep Reinforcement Learning with Image-based Representation","version":1},"cited_work":{"arxiv_id":"2111.06449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.06449","snapshot_observed_at":"2026-08-05T10:51:58.760460Z","title":"Expert Human-Level Driving in Gran Turismo Sport Using Deep Reinforcement Learning with Image-based Representation","venue":"cs.AI","work_id":"ae176950-54bc-4394-a722-74d6cbfffa1b","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.666721Z"},"links":{"cited_paper":"/paper/2111.06449","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3b09af341b52071ce78167b7fd6ba187f90304299be117b25b5514ebcf48e02e","observation_id":"1d45322b-cde5-4023-b260-d87baeef19e5","resolution":{"observed_at":"2026-08-05T10:51:58.764087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.288272Z","title":"Super - human performance in Gran Turismo Sport using deep reinforcement learning,","venue":null,"work_id":"e9e8a0b8-c6ba-406d-bb38-98d4ad3be0ff","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.669648Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:ec6d4562b9ba14773f82aeccbd45e1567a7b80082e6a1ad88b0efdf152ade2be","observation_id":"dd447118-6f53-4b10-91bd-8367c159e9cf","resolution":{"observed_at":"2026-08-05T10:51:59.291440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.672432Z","title":"Technical challenges of deploying reinforcement learning agents for game testing in AAA games,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.672432Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:75898d858c3db719c1a05301077f040dc480a47a7e726e421ef9224f64e5061a","observation_id":"818f4044-b49b-41ee-a22d-c328542eb0d3","resolution":{"observed_at":"2026-08-05T10:51:55.672432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.279936Z","title":"TD -Gammon, a self -teaching backgammon program, achieves master-level play,","venue":null,"work_id":"8cc435e5-173e-41bb-9109-df29322be784","year":1994},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.675255Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:bf711db76b653c57fb6b87fa8478ff0c30d181d2aaee0af265e887e0c6d37add","observation_id":"026565d2-c4ec-4647-bf27-6904c55f6a51","resolution":{"observed_at":"2026-08-05T10:51:59.282817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.271085Z","title":"Mastering the game of Go with dee p neural networks and tree search,","venue":null,"work_id":"0b4bdb6d-6dee-4277-9fc1-6bb76001eff4","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.678691Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:83820ccb2e2790aa598dadc53e1437cbf9751edad77c2df193971c99bbe43292","observation_id":"dfd2c73a-3f25-4751-b5b4-afd271f86c32","resolution":{"observed_at":"2026-08-05T10:51:59.273906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.262720Z","title":"Mastering the game of Go without human knowledge,","venue":null,"work_id":"7275a011-e38f-46e1-8946-8d041effe961","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.681980Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:8193ec173fab2526a9613ec02780ce4fe6e804bffda42c1c1e6f7fda17a01f32","observation_id":"eb4bf056-0c5d-49fd-8ebe-748b7f4ed752","resolution":{"observed_at":"2026-08-05T10:51:59.265704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.254094Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and Go through self -play,","venue":null,"work_id":"81052f52-f6dd-4044-901b-6ab5efe378af","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.684847Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e876299fc315f3d246a0d19a2a936c182eb735ca2767efe577807b70d2cf0d7b","observation_id":"5b3b063c-cc52-466b-a99b-cd092439fefd","resolution":{"observed_at":"2026-08-05T10:51:59.257313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.245824Z","title":"Grandmaster level in StarCraft II using multi -agent reinforcement learning,","venue":null,"work_id":"101f867c-ba03-45ea-90f3-20dc840ad080","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.687801Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:22a403b29c881c336280721e8679efe6ad9b76f2d015d4ceddd48ddc0d23d245","observation_id":"3f05b17c-0595-4caf-ac47-7fb4af6f2566","resolution":{"observed_at":"2026-08-05T10:51:59.248530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-08-13T14:13:07.807518Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-05T10:51:55.691234Z","title":"Dota 2 with larg e scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.691234Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:4b40fa96dc629ba86137ca93d34ca60527773bf790b4f8226cde8da85c7c6bb1","observation_id":"3950dc73-be06-4b29-a8fc-56182e26c553","resolution":{"observed_at":"2026-08-05T10:51:55.691234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2007.91391","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.678607Z","title":"A comprehensive survey of multiagent reinforcement learning,","venue":null,"work_id":"eaca5bde-7b10-47c1-a0c2-f7dec343489e","year":2008},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.694691Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:72eb9effbb566af3617f5f1408097b94ef647b883f6605ae70107924d004ca8f","observation_id":"a5d431b0-ccab-4b04-a14e-1adfbdc53f0f","resolution":{"observed_at":"2026-08-05T10:51:58.683334Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.697893Z","title":"Multi-agent reinforcement learning: A selective overview of theories and algorithms,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.697893Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:985d01296aa66a9b9b3975c856225dc31f01965bd279487ea66668ad467ba2c2","observation_id":"47c781be-8671-40e4-b91a-5110e6615ef6","resolution":{"observed_at":"2026-08-05T10:51:55.697893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.237374Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"68cf263d-cad7-4b08-a656-2e0b8332a7a3","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.701361Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c139609303343525608f2150955bc7df1df5d6785a8f09dea7946fd2820d6972","observation_id":"b6ef752c-d339-4902-b255-d84b16bc6bcc","resolution":{"observed_at":"2026-08-05T10:51:59.240497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.228837Z","title":"Multi-agent reinforcement learning: A review of challenges and applications,","venue":null,"work_id":"e901d237-b2e7-44a8-a9a4-c7bdc377661f","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.704424Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:dcb92142503aea358818a1c18b59cc21bc3153ddc4a16dabcf434d2cb0332913","observation_id":"582067ed-b6a6-48c8-ad1d-849f26540707","resolution":{"observed_at":"2026-08-05T10:51:59.231992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.220639Z","title":"Deep learning for video game playing,","venue":null,"work_id":"ec73081c-238a-4e2f-8f8d-f2ca652993b6","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.707328Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f292342e87dfbd2250267165bb73930007b5d15f4e9c30dc34ff09efc97091e9","observation_id":"fd6815f2-17ce-4627-9772-3248d1cb51fe","resolution":{"observed_at":"2026-08-05T10:51:59.223337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.212032Z","title":"Reinforcement learning in game industry—Review, prospects and challenges,","venue":null,"work_id":"3e23d032-c847-49cb-a7cf-5413d38aff47","year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.717199Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:87b819ecb23d42ee74733cf11ed285fb144989b294d9b328295384d903f3df60","observation_id":"f5e1955c-1ac4-4787-9075-f8c746809685","resolution":{"observed_at":"2026-08-05T10:51:59.215027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.203584Z","title":"Q-learning,","venue":null,"work_id":"903b560a-f313-4838-b333-97f0ca106418","year":1992},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.720267Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:8af7ea2fba76df2a5694ae8ef2b0f196ed8832480a1df8bafa975ea20b344d2f","observation_id":"320a8eb4-aeef-487f-8896-f017739cd99e","resolution":{"observed_at":"2026-08-05T10:51:59.206478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.195462Z","title":"Policy gradient methods for reinforcement learning with function approximation,","venue":null,"work_id":"85b54e42-0650-4f7f-b66d-4984acfa9d27","year":1999},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.723483Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:04ae3149a0ec4b502c3ccc088ec941db673699fe604ae00fc40f0f80a6660e65","observation_id":"54ac3f35-93ab-4148-a257-9fe103b35e6d","resolution":{"observed_at":"2026-08-05T10:51:59.198183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.186892Z","title":"Wooldridge, An Introduction to MultiAgent Systems , 2nd ed","venue":null,"work_id":"ee052ca7-c0f5-4785-988d-17855a2115d0","year":2009},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.726589Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:1360b239ad39d1ab4ba197ddec5a705b355472296f7c4785d3e69cdac920dba5","observation_id":"7c7cb991-9f4c-41e6-922b-a6089de2e0f6","resolution":{"observed_at":"2026-08-05T10:51:59.189913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.178592Z","title":"Modular AI,","venue":null,"work_id":"25139dd7-231e-4095-9c5b-23163a37e1a5","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.729621Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0eb93629e664ca3ddb203c558de789c70a4cca5bbfcb2ab0924280b4c59b2589","observation_id":"271dff9a-a9b8-4df8-9075-6fabca00527f","resolution":{"observed_at":"2026-08-05T10:51:59.181168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.170441Z","title":"Long short -term memory,","venue":null,"work_id":"c94feba5-dfb2-48e8-9ff2-01802b2558e4","year":1997},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.732768Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d6189cc7a24ec2ce8ba526426cd72f8b4d90d5e92034fc1c6584359b2bf17338","observation_id":"c5152184-8050-4e87-bb6f-292723c8c0d7","resolution":{"observed_at":"2026-08-05T10:51:59.173091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.162087Z","title":"Deep recurrent Q -learning for partially observable MDPs,","venue":null,"work_id":"c7e421fd-dd74-467b-ab0a-12e0713beec1","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.735651Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:02db07fb849f8f70efcde7a9ab9ad38e2cc2f1737a3a1d9227aac052ceee27e7","observation_id":"240dde50-bde1-4897-9eae-01f42ef520d2","resolution":{"observed_at":"2026-08-05T10:51:59.165087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.153661Z","title":"Rainbow: Combining improvements in deep reinforcement learning,","venue":null,"work_id":"05012b16-7725-47e0-a1c1-adc70ad38e8a","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.739171Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:2db833b639b13e2ab84107f404e0d099275d650dc6ecf99aeccc70f77c9a626b","observation_id":"4185fa3e-7f39-4282-a920-c12c015e12ba","resolution":{"observed_at":"2026-08-05T10:51:59.156750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.145147Z","title":"Actor-critic algorithms,","venue":null,"work_id":"185fd42b-92df-48bf-9793-967ee6694fb0","year":2000},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.742552Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0f5ffc3e08565444edc6d90e45d389ec913c7e10c11a3638e55f46c5015e160c","observation_id":"c0f59460-76f9-4e9d-ab05-a7c921e5764a","resolution":{"observed_at":"2026-08-05T10:51:59.148062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T10:51:55.745729Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.745729Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:fb6c7d4d0921c20a9b0effccb9b3651bf95f3dab9e1bb43eb482e95aae010693","observation_id":"d5e8b191-0414-4978-b80f-ae085f5f78d0","resolution":{"observed_at":"2026-08-05T10:51:55.745729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T10:51:55.749220Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.749220Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b12935a2cfe3ec4a2f8a0aeaf2409ef18612e5e59a8da805e5d417ab71e72b6e","observation_id":"e00150c8-e970-4b99-a887-2b0c88d917c7","resolution":{"observed_at":"2026-08-05T10:51:55.749220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.752466Z","title":"Shoham and K","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.752466Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:733805318f4994b49e125a0a6606b12a1bb6d4b812e79a7f01ba018ce944ccac","observation_id":"3e8f741e-bf32-47b2-a334-188455af2349","resolution":{"observed_at":"2026-08-05T10:51:55.752466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.135768Z","title":"Markov games as a framework for multi -agent reinforcement learning,","venue":null,"work_id":"a055556a-b547-4401-b242-eb3d6d38d4ce","year":1994},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.755645Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d8dc78f7c6b7b28d71bb4856f1c3d0e7e002c7ad4403572733ab3914365d815e","observation_id":"5c2b3359-e747-4b8b-a572-6b9c88c8d7b2","resolution":{"observed_at":"2026-08-05T10:51:59.138716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.127102Z","title":"Multiagent reinforcement learning: Theoretical framework and an algorithm,","venue":null,"work_id":"fbd09f8b-1b35-4073-a8c6-85aa1a6e3768","year":1998},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.759034Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:4eaff77aa2019b90d1a5783111d5697d9f627b8e14aa8e38844e7d25b0b94e0a","observation_id":"35e12052-9979-4661-b672-7cf6d0025978","resolution":{"observed_at":"2026-08-05T10:51:59.129920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-08-10T10:13:54.999657Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T10:51:55.762086Z","title":"StarCraft II: A new challenge for reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.762086Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:43bc02ceb43d0ad45681e326998c7a4aa462b4d76f2f718f9a928e1419fb5ea0","observation_id":"8902f8c8-294d-4d93-add5-e6776e5ee564","resolution":{"observed_at":"2026-08-05T10:51:55.762086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-10T17:28:09.498763Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-05T10:51:55.765630Z","title":"The StarCraft multi -agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.765630Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:a9202b65e54c690cd256dc55040652708bdd8d7b819e3e94a7ef7c04f7291cb5","observation_id":"5306b4e4-2b89-4618-b7ec-3ee871a64e7c","resolution":{"observed_at":"2026-08-05T10:51:55.765630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0875.11808","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.543259Z","title":"Strangers and friends,","venue":null,"work_id":"5dc61e71-95e5-4bd4-8bc7-857d62e97c94","year":2006},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.769658Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f2dd8baf832fc2a6b609c8ddc9ac525e82f2107abd6dfd7bf4770bf8a6a2024b","observation_id":"fc3e5dbe-5ac3-47c7-acaf-b65725809964","resolution":{"observed_at":"2026-08-05T10:51:58.549403Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33011206","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Hierarchical macro strategy model for MOBA game AI,","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"050e8629-fe52-4cd6-8209-411f1bb2d8bb","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.773168Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:242ed5584b757e27985ce0f6b02de12441171215aca5aa3abd54c007d68bfcf6","observation_id":"c9fddd94-74a2-4742-9f6a-bbdb43bbfc84","resolution":{"observed_at":"2026-08-05T10:51:56.901678Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.118550Z","title":"Unifying temporal and structural credit assignment problems,","venue":null,"work_id":"6f42ad51-3ffe-47b7-96ff-58725f1ed9cf","year":2004},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.776471Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:de97bd6384b83843ce00e7de8b3a22cdbfe85d1a2a1015e868a45c6d57ff6076","observation_id":"b5b8daba-1c1d-48aa-9ce3-dcf29d763bbf","resolution":{"observed_at":"2026-08-05T10:51:59.121596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.109869Z","title":"Multiagent systems: A survey from a machine learning perspective,","venue":null,"work_id":"d3ea6ecb-add7-40af-b272-02fbc03f5b58","year":2000},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.780653Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:fc72690d023634968d31446d1ee4203a27e4d0bf2495ddafea2230800d86e0c6","observation_id":"082d136e-6184-4726-8ff8-1a16689a4d5b","resolution":{"observed_at":"2026-08-05T10:51:59.112885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.101595Z","title":"Temporal difference learning and TD-Gammon,","venue":null,"work_id":"a1a24db0-4829-4822-9bf2-ba0e116813d4","year":1995},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.783776Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3e4ae9c88b370537930a31ccf64bdd6181a83487b2351fe794086dd38a94c65c","observation_id":"b444575f-b6e4-4039-a178-70caab8228eb","resolution":{"observed_at":"2026-08-05T10:51:59.104463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.092298Z","title":"Creating pro-level AI for a real -time fighting game using deep reinfo rcement learning,","venue":null,"work_id":"07f71edb-602c-4c9b-a99e-3deb29fbaa08","year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.786788Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:cbc9780794628887e05d877057d3527546613a5797c475b33aa6ce991477f8ee","observation_id":"41f21917-81ed-417a-bbdb-01d46b2ab0d2","resolution":{"observed_at":"2026-08-05T10:51:59.095717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.083663Z","title":"On the utility of learning about humans for human-AI coordination,","venue":null,"work_id":"872251e7-2287-44bd-b8c4-9de86794999d","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.790699Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:cbdf84b3074bd2b88c28e2d2f21e3507ad2ab910a91fe824b13aa14cddb4809b","observation_id":"eeed4ad4-a83b-4536-8958-ff13cd1f0f2c","resolution":{"observed_at":"2026-08-05T10:51:59.086582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.073086Z","title":"IMPALA: Scalable distributed deep -RL with importance weighted actor -learner architectures,","venue":null,"work_id":"014d8a1b-3a38-4786-92fc-74a522c5c620","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.797249Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:edc53d88266b7d1f24745467fcf847717ab5766320cb124dfb4efffc4b8ddfda","observation_id":"c7166dbd-189a-4e17-a3c9-2a5a0656d18c","resolution":{"observed_at":"2026-08-05T10:51:59.077970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00933","last_updated":"2018-03-02T16:21:46Z","snapshot_observed_at":"2026-07-06T06:26:20.207918Z","submitted_at":"2018-03-02T16:21:46Z","title":"Distributed Prioritized Experience Replay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00933","snapshot_observed_at":"2026-08-05T10:51:55.800948Z","title":"Distributed prioritized experience replay,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.800948Z"},"links":{"cited_paper":"/paper/1803.00933","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:22ee8bfa5736068a15ab4f9949bd363b1a26d0389fe5fb5ed117977396913b29","observation_id":"553d7982-96b7-43f5-b711-3a185e24236b","resolution":{"observed_at":"2026-08-05T10:51:55.800948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.063746Z","title":"Make a more engaging game w/ ML -Agents | Machine learning bots for game development | Reinforcement learning | Unity","venue":null,"work_id":"e12f12be-0317-47cf-aa59-f804531f5478","year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.804667Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:7277f7eac10a18de931feed51d440be9b7e6074619681bf331e9c5c76ab81d94","observation_id":"5565a883-acd2-49b2-b9f5-2cbba4b28c59","resolution":{"observed_at":"2026-08-05T10:51:59.066823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06031","last_updated":"2020-12-10T23:53:15Z","snapshot_observed_at":"2026-08-05T18:03:11.537612Z","submitted_at":"2020-12-10T23:53:15Z","title":"Reinforcement Learning Agents for Ubisoft's Roller Champions","version":1},"cited_work":{"arxiv_id":"2012.06031","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.06031","snapshot_observed_at":"2026-08-05T10:51:57.248855Z","title":"Reinforcement Learning Agents for Ubisoft's Roller Champions","venue":"cs.LG","work_id":"1a478c1f-9399-4674-b8a7-97ed4974fb28","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.807744Z"},"links":{"cited_paper":"/paper/2012.06031","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b6272e3edc71c95a6336804b317582b2421cedce8720e011aa3d9c826afc00d9","observation_id":"054b1f78-c6ba-4b25-88e1-afee7779b33a","resolution":{"observed_at":"2026-08-05T10:51:57.252051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.055139Z","title":"MonoBehaviour.FixedUpd ate,","venue":null,"work_id":"9338f0c3-45b4-462e-b080-efa26e66d5cd","year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.811103Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c2c60d9176665b31169796157525384908b207d9fd4a33bbc3a76a20b0c1f4fc","observation_id":"edc2a936-49b7-4ec0-979d-91ac9037ea7b","resolution":{"observed_at":"2026-08-05T10:51:59.058040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.816478Z","title":"On the verge of solving Rocket League using deep reinforcement learning and sim -to-sim transfer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.816478Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c9b0406a045e77f1962168a83692c28c86b2dbd463f3fd317012a1922a01a175","observation_id":"df03024e-f9fc-4dd5-b893-03ac76d1ca89","resolution":{"observed_at":"2026-08-05T10:51:55.816478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.833322Z","title":"On the potential of Rocket League for driving team AI development,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.833322Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e8422ba4fdaf938fc789f3138d9b0cc5d9a11e0c808698cd72ac6ce9f32497c8","observation_id":"ae116335-4acc-41bd-a285-294bdef4c91d","resolution":{"observed_at":"2026-08-05T10:51:55.833322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.046307Z","title":"Lucy - SKG: Learning to play Rocket League efficiently using deep reinforcement learning,","venue":null,"work_id":"9244a691-6ea6-4648-8bd9-6fd9842bcdee","year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.954533Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:64794177dfe333ed6a1f19a7bcb6568c31465a81c1dcfee7768324f560967134","observation_id":"094bd1ae-03e0-4684-a67a-1824421a36c1","resolution":{"observed_at":"2026-08-05T10:51:59.049561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.037954Z","title":"RLGym: Reinforcement learning in Rocket League,","venue":null,"work_id":"43da6e0f-65b3-4a7b-ac39-c52ac1498d92","year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.026084Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0b032509395adfe9069e5b99c7a096c17d9c86b7c45e91cf1cdb0be4503bea4b","observation_id":"9eb748f6-de58-4633-a415-2ce34a92f1e0","resolution":{"observed_at":"2026-08-05T10:51:59.040763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.029980Z","title":"Attention is all you need,","venue":null,"work_id":"d827c7f7-32fc-4f4a-895f-83bde97c2ec2","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.079281Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f0203503e13e194b25c32b54d734a7aef9c5088f87f6ae9187a12849038b2812","observation_id":"63952c26-80dc-4eae-b2dc-282e6a0bf633","resolution":{"observed_at":"2026-08-05T10:51:59.032720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.78604","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:57.146197Z","title":"ViZDoom: A Doom-based AI research platform for visual reinforcement learning,","venue":null,"work_id":"952fccb6-2fe9-4546-ab96-4a0f1daed762","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.136791Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:1016ef59f6968c4992e1b47d40b9f1e512045d91594b37c83436df77b50d8d48","observation_id":"5764aed7-f6c3-4485-8d58-538e0a4c93ee","resolution":{"observed_at":"2026-08-05T10:51:57.151109Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.021530Z","title":"ViZDoom competitions: Playing Doom from pixels,","venue":null,"work_id":"75808f21-e0de-4551-ba55-716ef819a2c7","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.164586Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:70d71c8ab998c98edb4c31f77c8733ac1a5a08867d67d3e23b6d1aa446f6cb8a","observation_id":"19a7ccd9-0741-4dec-9c58-31546c90237f","resolution":{"observed_at":"2026-08-05T10:51:59.024639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.013025Z","title":"Training agent for first -person shooter game with actor-critic curriculum learning,","venue":null,"work_id":"e9878f44-45b6-4e11-b7f4-55da3ef99241","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.181626Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e5471f3343f962a3692b26167b510e42be7a4409161c1513d142427b348621f7","observation_id":"5b694b81-2fec-4a90-aebe-9f8a40f199b9","resolution":{"observed_at":"2026-08-05T10:51:59.015956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-05T10:51:56.247540Z","title":"Asynchronous methods for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.247540Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:ba451b2fe4f662c5b19252155b5beb17b63dcd170c1ebfbff4e75d7d9a439a0f","observation_id":"248a5cbe-6cef-4ebd-8c7d-b93670f362d6","resolution":{"observed_at":"2026-08-05T10:51:56.247540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.004822Z","title":"A Mi necraft-based simulated task environment for human-AI teaming,","venue":null,"work_id":"735ab154-ef0e-43f8-b541-b674238a9818","year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.364463Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:027c60c9054de762c36abb4dbbbd98e6f7960f9f9e82b4aaed4001f8f925494e","observation_id":"49c5c432-aa1e-4b8b-b95f-9775516cd58f","resolution":{"observed_at":"2026-08-05T10:51:59.007758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.996208Z","title":"Minecraft as an experimental world for AI in robotics,","venue":null,"work_id":"1c82e800-b06a-40e2-9c2d-73c924b16d0c","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.478414Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:01f8c1fd1f0aa55473d77188c7cf50185f196d811add310a80caac0fcd6ec137","observation_id":"2b02d60e-b1cd-4ceb-afe1-53f4c027e04f","resolution":{"observed_at":"2026-08-05T10:51:58.999155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13440","last_updated":"2019-07-29T18:10:30Z","snapshot_observed_at":"2026-08-12T08:28:46.357425Z","submitted_at":"2019-07-29T18:10:30Z","title":"MineRL: A Large-Scale Dataset of Minecraft Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13440","snapshot_observed_at":"2026-08-05T10:51:56.541888Z","title":"MineRL: A large -scale dataset of Minecraft demonstrations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.541888Z"},"links":{"cited_paper":"/paper/1907.13440","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:47611c21cab15852ae4fe545cee654f4faa62c8ebc74d061d86fbe2c4eb97a2f","observation_id":"f5cf9446-1f41-4d73-a477-67dceeaac09b","resolution":{"observed_at":"2026-08-05T10:51:56.541888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.987725Z","title":"The Malmo platform for artificial intelligence experimentation,","venue":null,"work_id":"3f68fb01-4908-4bcb-8fd7-b1be183ca2ad","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.639919Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:04aba96981d55dbe41120d21b496ab5893bcfcde923e426746aad50661e70a12","observation_id":"db2aee90-238f-43b6-830a-971aa0f9aade","resolution":{"observed_at":"2026-08-05T10:51:58.990767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.979526Z","title":"The Malmo Collaborative AI Challenge - Microsoft Research,","venue":null,"work_id":"d59b9dee-6ab2-49ab-9ae3-b62553d12c92","year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.749020Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:cacc6069186944731163e41a6e37b2d49089ac7b74bbdf8a3587557f87df09aa","observation_id":"01c0b6c7-1d91-4fe5-a6dd-ee4af71c91fc","resolution":{"observed_at":"2026-08-05T10:51:58.982508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.970962Z","title":"HogRider: Champion agent of Microsoft Malmo collaborative AI challenge,","venue":null,"work_id":"c5f9a449-8a04-4f9f-a9e4-5da4bc2e4bfb","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.839927Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e0485fc8268b62b5d869fabfdd50cf0fd8e6c2870feb0b3d2e80a95742f810be","observation_id":"7cec5d4a-6e77-4cf2-902d-0dc251050807","resolution":{"observed_at":"2026-08-05T10:51:58.973783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08129","last_updated":"2025-04-11T11:14:27Z","snapshot_observed_at":"2026-08-10T18:30:22.384526Z","submitted_at":"2019-01-23T21:01:27Z","title":"The Multi-Agent Reinforcement Learning in Malm\\\"O (MARL\\\"O) Competition","version":2},"cited_work":{"arxiv_id":"1901.08129","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08129","snapshot_observed_at":"2026-08-05T10:51:56.964429Z","title":"The Multi-Agent Reinforcement Learning in Malm\\\"O (MARL\\\"O) Competition","venue":"cs.AI","work_id":"0182dfd3-7770-4cf1-a439-8d907eed5967","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.843854Z"},"links":{"cited_paper":"/paper/1901.08129","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:5c6a71840bf2f19d7bc1b88929d12a3e8c4616a0f58d37d1d746050e077d9fbd","observation_id":"7a5f6f14-9b39-45ac-ac7d-23ee78b5bfe8","resolution":{"observed_at":"2026-08-05T10:51:56.968079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.962321Z","title":"Human-level performance in 3D multiplayer games with population -based reinforcement learning,","venue":null,"work_id":"974bcdd7-a8ee-4df3-abb8-0dccab6b604c","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.846950Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:9cae819acb99bf06d46521f95c09dcaf84304a97cf1b0ab227d5f0b5490f7bda","observation_id":"196001a9-ce51-4e74-91b1-467615f4bc88","resolution":{"observed_at":"2026-08-05T10:51:58.965344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.953705Z","title":"The exploration - exploitation dilemma: A multidisciplinary framework,","venue":null,"work_id":"97df7141-c9ad-4d36-bb51-78861b1cbbbd","year":2014},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.849629Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e15596f9ebe7326a1055a6436b72a17d50e6a305d4a6fb87209e8a05c0406bca","observation_id":"c3f383b5-3c07-40f8-ae77-efa9cff09a02","resolution":{"observed_at":"2026-08-05T10:51:58.956756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.944827Z","title":"AlphaStar: Mastering the real -time strategy game StarCraft II,","venue":null,"work_id":"e06bd273-be82-434b-be2b-543c971f1660","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.852283Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d38cedb6de8c4d43a573dcd23fe98e64ca5b03a53ad7252b4d5aa7f0c3d41805","observation_id":"f1e90818-862a-43aa-91f7-a7fc0841c3eb","resolution":{"observed_at":"2026-08-05T10:51:58.947906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.935453Z","title":"Grid-wise control for multi-agent reinforcement learning in video game AI,","venue":null,"work_id":"b249f7f9-6bc2-41e4-b3f4-165e05f60840","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.855374Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:bf9577939197809b7489288c372ea6b57e280091ded87ad7057a5a9778256916","observation_id":"e5d1e515-c21c-4c48-9e89-6d7513a017fa","resolution":{"observed_at":"2026-08-05T10:51:58.938545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10069","last_updated":"2017-09-14T12:45:46Z","snapshot_observed_at":"2026-07-06T05:35:43.650268Z","submitted_at":"2017-03-29T14:37:25Z","title":"Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10069","snapshot_observed_at":"2026-08-05T10:51:56.858825Z","title":"Multiagent bidirectionally-coordinated nets: Emergence of human-level coordination in learning to play StarCraft combat games,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.858825Z"},"links":{"cited_paper":"/paper/1703.10069","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:1cabd57e5760353cd0f4d3c5746f4f976592896778d27d4477f7d114986245d7","observation_id":"9df9b4dd-c55f-429e-87de-0df495dda9e0","resolution":{"observed_at":"2026-08-05T10:51:56.858825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.925742Z","title":"Ye, et al., Towards playing full MOBA games with deep reinforcement learning, vol","venue":null,"work_id":"f413b4db-56e5-4713-a753-1b92971ff355","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.862563Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3b12e2a80efa97d47ffb3845c82b2c851c17ad79713a478f771bd5420e27fbaa","observation_id":"eff00d2b-5e4c-4e9d-9932-004e4866158b","resolution":{"observed_at":"2026-08-05T10:51:58.928821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.917045Z","title":"A recommender system for hero line-ups in MOBA games,","venue":null,"work_id":"585ae0ec-0f95-4db2-8be0-cde04952f3aa","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.865286Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f863f683b2a44ab851715c866c2db67d64dbf3ff5e8d8c4fd90b7985e4c15b83","observation_id":"80e174de-bc66-4a8d-82ef-3ad4065713ba","resolution":{"observed_at":"2026-08-05T10:51:58.920163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10130","last_updated":"2018-06-26T17:59:09Z","snapshot_observed_at":"2026-08-11T19:34:22.070582Z","submitted_at":"2018-06-26T17:59:09Z","title":"The Art of Drafting: A Team-Oriented Hero Recommendation System for Multiplayer Online Battle Arena Games","version":1},"cited_work":{"arxiv_id":"1806.10130","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.10130","snapshot_observed_at":"2026-08-05T10:51:56.942456Z","title":"The Art of Drafting: A Team-Oriented Hero Recommendation System for Multiplayer Online Battle Arena Games","venue":"cs.AI","work_id":"46eb2541-6d9b-4ab8-bf2e-bc91c6479a9b","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.867925Z"},"links":{"cited_paper":"/paper/1806.10130","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:78a721aedf106138ea92215bd2b510d678069a328f7e7927240641276de7a82e","observation_id":"7cf67657-3f80-4647-87b7-b2cd5872e63d","resolution":{"observed_at":"2026-08-05T10:51:56.945969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.906884Z","title":"Acting with style: Towards designer-centred reinforcement learning for the video games industry,","venue":null,"work_id":"55c60f22-cb98-4c5c-82d3-57fc26d26f7b","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.870832Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b86a194895c96fd11f23d0e7f69f4a14b057f52a2b44c3897f2b1e6dfec5d955","observation_id":"36fbe881-e683-4567-876b-e6edf724df5f","resolution":{"observed_at":"2026-08-05T10:51:58.911380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10944","last_updated":"2019-12-26T14:47:34Z","snapshot_observed_at":"2026-07-06T08:46:35.151523Z","submitted_at":"2019-12-23T16:04:40Z","title":"A Survey of Deep Reinforcement Learning in Video Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10944","snapshot_observed_at":"2026-08-05T10:51:55.714335Z","title":"Available: https://arxiv.org/abs/1912.10944","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.714335Z"},"links":{"cited_paper":"/paper/1912.10944","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:adecf231d7875a146d6b8584f99ae081d8fb5d97383d452c72e80daebe0b37f6","observation_id":"418233a4-e818-4275-857a-7746f2530211","resolution":{"observed_at":"2026-08-05T10:51:55.714335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.545689Z","title":"Available: https://www.grandviewresearch.com/ industry-analysis/video-game-market","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.545689Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c323058ce427c41cbdd5f167749b45d3e38c979ae06b967bbd56e4e920ec0914","observation_id":"b57a8584-71b8-4c2a-97c9-eca9497c757d","resolution":{"observed_at":"2026-08-05T10:51:55.545689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":21,"verified_exact":7,"verified_fuzzy":51},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2509.03682."}