{"as_of":"2026-08-08T18:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c898954f52cbecfc2951f45c303f168412927c8ac915f19aff3c635ff76e9f9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":64,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:54:46.219795Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":185,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-08T17:54:46.219795Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.05812","last_updated":"2025-02-09T08:35:09Z","snapshot_observed_at":"2026-08-08T17:48:43.549946Z","submitted_at":"2025-02-09T08:35:09Z","title":"Multi-Agent Reinforcement Learning in Wireless Distributed Networks for 6G","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T17:54:46.219795Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2502.05812"},"observation_digest":"sha256:01cd5ad069ab62b1760ca47a89deb593edd2b960783869afa8a2f444772a6b05","observation_id":"6ec871c0-186a-4ef7-97e2-85e15d0d0a6f","resolution":{"observed_at":"2026-08-08T17:54:46.219795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T14:10:42.712252Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.712252Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3ea5a14722c8267a5ac6dc6d25531ef4c6ffdb3d1735f0b5d209ad2eac1dbe29","observation_id":"8463c1e6-1c4a-4b5e-8678-8e0ffa96a375","resolution":{"observed_at":"2026-08-07T14:10:42.712252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T13:26:21.357391Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21985","last_updated":"2025-05-28T05:23:47Z","snapshot_observed_at":"2026-08-07T13:15:59.929857Z","submitted_at":"2025-05-28T05:23:47Z","title":"Reward-Independent Messaging for Decentralized Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:21.357391Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2505.21985"},"observation_digest":"sha256:95132deae4fa786fbd104e87ae21871570dcda9c3fbe4c84ce89183c8bcae12d","observation_id":"4fffc0d1-5f82-4660-9110-ca70ab555c5d","resolution":{"observed_at":"2026-08-07T13:26:21.357391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T11:20:17.289699Z","title":"Is Independent Learning All You Need in the Starcraft Multi-Agent Challenge?","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.02849","last_updated":"2026-06-20T14:03:13Z","snapshot_observed_at":"2026-08-07T11:11:58.487446Z","submitted_at":"2025-06-03T13:19:23Z","title":"Learned Controllers for Agile Quadrotors in Pursuit-Evasion Games","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:17.289699Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.02849"},"observation_digest":"sha256:7604889a6bd6558f5860e181c290f536803f32721b162ccebbee62486ce47e94","observation_id":"151d4bf0-1dde-4c0e-aaa3-882ffcd8ca40","resolution":{"observed_at":"2026-08-07T11:20:17.289699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T05:27:42.322530Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.08149","last_updated":"2025-06-09T18:56:40Z","snapshot_observed_at":"2026-08-07T10:01:44.083957Z","submitted_at":"2025-06-09T18:56:40Z","title":"Ego-centric Learning of Communicative World Models for Autonomous Driving","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:42.322530Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.08149"},"observation_digest":"sha256:2f9eae8b0f3d9e079753be4cde1941f2a483102c73e1e3679f54cb5d6073a8ee","observation_id":"cc8230f2-a2e1-424a-b004-9d4ea9a10a05","resolution":{"observed_at":"2026-08-07T05:27:42.322530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T04:21:10.128628Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.11285","last_updated":"2025-06-12T20:44:09Z","snapshot_observed_at":"2026-08-07T04:09:25.533458Z","submitted_at":"2025-06-12T20:44:09Z","title":"Shapley Machine: A Game-Theoretic Framework for N-Agent Ad Hoc Teamwork","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:21:10.128628Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.11285"},"observation_digest":"sha256:c1a23cd86f97db5253c7bf8c8ac8833ba07be2892861e38aa9cbf0aea5b3e5cc","observation_id":"1cb38867-b96c-4486-8a22-c273d4b39341","resolution":{"observed_at":"2026-08-07T04:21:10.128628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T00:23:07.338517Z","title":"Ellis, B., Cook, J., Moalla, S., Samvelyan, M., Sun, M., Mahajan, A., Foerster, J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.14164","last_updated":"2025-06-17T03:57:28Z","snapshot_observed_at":"2026-08-07T00:15:55.403596Z","submitted_at":"2025-06-17T03:57:28Z","title":"Light Aircraft Game : Basic Implementation and training results analysis","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:07.338517Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.14164"},"observation_digest":"sha256:de55a6a2982ee50950a45f5659273deed6f2a36cf1a5ec293926ab2ad9a9aa4b","observation_id":"c7a71b39-099c-497a-b166-ee3f0ee49430","resolution":{"observed_at":"2026-08-07T00:23:07.338517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T00:16:41.270716Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.14990","last_updated":"2026-06-18T15:11:38Z","snapshot_observed_at":"2026-08-07T11:55:17.356594Z","submitted_at":"2025-06-17T21:50:04Z","title":"MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:16:41.270716Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.14990"},"observation_digest":"sha256:d01271558e5c5be61a199df17138212be691456cd870ba7dd3efee11d9b4bade","observation_id":"7c8a6b96-3f52-49e1-8287-a1e886218b86","resolution":{"observed_at":"2026-08-07T00:16:41.270716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T23:21:19.634849Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.18627","last_updated":"2025-06-23T13:34:27Z","snapshot_observed_at":"2026-08-06T23:13:35.734512Z","submitted_at":"2025-06-23T13:34:27Z","title":"Multi-Agent Reinforcement Learning for Inverse Design in Photonic Integrated Circuits","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:21:19.634849Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2506.18627"},"observation_digest":"sha256:be244718134b466e341501256f82cc9f37087e08f2803793aa5d55dd382d4f95","observation_id":"10e44326-8fc5-4b40-84b8-3c1f2a12265b","resolution":{"observed_at":"2026-08-06T23:21:19.634849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T19:36:24.037355Z","title":"Is independent learning all you need in the starcraft multi-agent chal- lenge? arXiv preprint arXiv:2011.09533 , 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.05244","last_updated":"2025-07-07T17:53:13Z","snapshot_observed_at":"2026-08-06T19:26:47.466298Z","submitted_at":"2025-07-07T17:53:13Z","title":"Modeling Latent Partner Strategies for Adaptive Zero-Shot Human-Agent Collaboration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:36:24.037355Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.05244"},"observation_digest":"sha256:c23c44e5b11fff829eeca676418151fc4a07ac2e93fdcf9657f7d3179277dcd0","observation_id":"2fad4f2c-c997-4100-81cc-a901aa55b9d5","resolution":{"observed_at":"2026-08-06T19:36:24.037355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T19:17:09.418866Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06004","last_updated":"2025-07-08T14:07:53Z","snapshot_observed_at":"2026-08-07T08:46:11.836572Z","submitted_at":"2025-07-08T14:07:53Z","title":"From General Relation Patterns to Task-Specific Decision-Making in Continual Multi-Agent Coordination","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T19:17:09.418866Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.06004"},"observation_digest":"sha256:7db673fb078cc36bd1da8fb133688ba84cc75b2e7f58c8b05dc904fd6ced3a16","observation_id":"29ed48fb-af18-4bbb-bcec-f3f6ee44af59","resolution":{"observed_at":"2026-08-06T19:17:09.418866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T18:46:36.585985Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.07376","last_updated":"2025-07-10T02:10:18Z","snapshot_observed_at":"2026-08-06T18:40:14.583619Z","submitted_at":"2025-07-10T02:10:18Z","title":"PILOC: A Pheromone Inverse Guidance Mechanism and Local-Communication Framework for Dynamic Target Search of Multi-Agent in Unknown Environments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:46:36.585985Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.07376"},"observation_digest":"sha256:3b06e6f8b88a7ab9cc4b002baa4d6c00cd24f103377e50ad1c7f1b6ae86b181e","observation_id":"2729afa7-3aae-44c5-8a06-02ff6f962091","resolution":{"observed_at":"2026-08-06T18:46:36.585985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T17:57:08.739276Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.739276Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:7552ed7ef0ad7c2cc825c1ac473ddd9894660995e186af2d7a5e95fd9a22fba0","observation_id":"ed8b3a49-49a0-4982-8c8f-1ce125f74f43","resolution":{"observed_at":"2026-08-06T17:57:08.739276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T17:42:53.723048Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.10142","last_updated":"2026-07-22T04:23:01Z","snapshot_observed_at":"2026-08-07T20:29:46.771527Z","submitted_at":"2025-07-14T10:39:17Z","title":"Toward Adaptable Multi-Agent Reinforcement Learning: An Assumption-Aware Review","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:53.723048Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.10142"},"observation_digest":"sha256:5a53b0c2391250d63f97076594937ecc73d6b72fb1e33d886dfce9dd80a0b766","observation_id":"7e8f0393-2fad-4f5b-9c8a-e71f9b3cd339","resolution":{"observed_at":"2026-08-06T17:42:53.723048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T15:51:33.831087Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.14850","last_updated":"2025-08-18T09:13:18Z","snapshot_observed_at":"2026-08-06T15:43:42.594617Z","submitted_at":"2025-07-20T07:43:18Z","title":"Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:51:33.831087Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.14850"},"observation_digest":"sha256:52a6503e7365aa7ba6c23193ed5b04f68d24b47372f835cb3934e6e6952dfc11","observation_id":"785fc717-1c9c-4fb2-8948-2fa9f696657d","resolution":{"observed_at":"2026-08-06T15:51:33.831087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2507.15351","last_updated":"2026-04-16T08:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-21T08:04:31Z","title":"One Step is Enough: Multi-Agent Reinforcement Learning based on One-Step Policy Optimization for Order Dispatch on Ride-Sharing Platforms","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-19T04:30:49.870610Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.15351"},"observation_digest":"sha256:a0802965b91b0ae4be64498476c87e42b6e82287b10d3399798cef6b279add1f","observation_id":"b99431d3-2252-4f03-b794-098f943e8cf2","resolution":{"observed_at":"2026-05-19T04:32:03.586785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T15:04:18.186263Z","title":"Available: https://arxiv.org/abs/2011.09533","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.16941","last_updated":"2025-07-22T18:24:23Z","snapshot_observed_at":"2026-08-06T17:47:08.492848Z","submitted_at":"2025-07-22T18:24:23Z","title":"Multi-agent Reinforcement Learning for Robotized Coral Reef Sample Collection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:18.186263Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.16941"},"observation_digest":"sha256:08660a0a2e874e56d0693582d96f85d13b015f37ddf9598c3f3c79ef16b72677","observation_id":"d0491786-5116-4372-8068-9df78d2c8681","resolution":{"observed_at":"2026-08-06T15:04:18.186263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-06T10:40:38.723696Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.23604","last_updated":"2026-06-30T11:26:47Z","snapshot_observed_at":"2026-08-07T03:53:17.805976Z","submitted_at":"2025-07-31T14:42:12Z","title":"Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:40:38.723696Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.23604"},"observation_digest":"sha256:3ae959a25e2824e1dfa6cb39cf2001b1638e51938b0a4bc6f6cb14d5aa67cd4d","observation_id":"641553b5-d867-47a2-8fd7-c31dfe4a22ff","resolution":{"observed_at":"2026-08-06T10:40:38.723696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2508.01049","last_updated":"2026-05-13T06:44:44Z","snapshot_observed_at":"2026-08-08T12:18:37.956029Z","submitted_at":"2025-08-01T20:07:25Z","title":"Centralized Adaptive Sampling for Reliable Co-Training of Independent Multi-Agent Policies","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T01:05:17.086399Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.01049"},"observation_digest":"sha256:3287e4cb5edd2ccb06f4fa26ea43f2db22ec0770bb9c7b3fe6c1bd35c72c8a9f","observation_id":"40c7aafe-1818-47aa-bfd5-9d4235072655","resolution":{"observed_at":"2026-05-19T01:06:57.382182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T20:31:02.015643Z","title":"S.; Gupta, T.; Makoviichuk, D.; Makoviychuk, V.; Torr, P","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10340","last_updated":"2025-08-14T04:48:46Z","snapshot_observed_at":"2026-08-05T20:31:00.429141Z","submitted_at":"2025-08-14T04:48:46Z","title":"Multi-Agent Trust Region Policy Optimisation: A Joint Constraint Approach","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T20:31:02.015643Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.10340"},"observation_digest":"sha256:112196575cf7491288078db180773c74c56e77f9c1bf8f26b813915524627110","observation_id":"fe83a0c0-68b9-41ed-9c36-27b5f677bcc3","resolution":{"observed_at":"2026-08-05T20:31:02.015643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T15:18:51.513389Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20018","last_updated":"2025-08-27T16:27:19Z","snapshot_observed_at":"2026-08-08T06:36:18.346761Z","submitted_at":"2025-08-27T16:27:19Z","title":"SWIRL: A Staged Workflow for Interleaved Reinforcement Learning in Mobile GUI Control","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:18:51.513389Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.20018"},"observation_digest":"sha256:0444b6d2f210aac0f85b1bb9eab229a1489c1d4ad077dad6cfd56ef650d0ba73","observation_id":"0bc4c11f-ff7c-463c-8aba-3745abd36ad5","resolution":{"observed_at":"2026-08-05T15:18:51.513389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T14:49:53.119707Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V., Torr, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.20818","last_updated":"2025-08-28T14:16:17Z","snapshot_observed_at":"2026-08-07T17:56:45.782981Z","submitted_at":"2025-08-28T14:16:17Z","title":"cMALC-D: Contextual Multi-Agent LLM-Guided Curriculum Learning with Diversity-Based Context Blending","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T14:49:53.119707Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.20818"},"observation_digest":"sha256:24379bd22bbe855bf6f78f1a319717d20280d2bb48a403810f534c987b08b537","observation_id":"6553f578-418f-4acb-ae10-16c3f6421f03","resolution":{"observed_at":"2026-08-05T14:49:53.119707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-04T17:49:15.375927Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10656","last_updated":"2026-07-05T23:05:41Z","snapshot_observed_at":"2026-08-08T12:41:14.961784Z","submitted_at":"2025-09-12T19:35:20Z","title":"Self-Supervised Goal-Reaching Results in Multi-Agent Cooperation and Exploration","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T17:49:15.375927Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2509.10656"},"observation_digest":"sha256:724922cc229e008026665104c941e213d5b76157eecd300864e90a61724414a0","observation_id":"d6846655-e972-411a-8fde-568ab8c6d1f7","resolution":{"observed_at":"2026-08-04T17:49:15.375927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2509.17676","last_updated":"2026-04-18T21:16:15Z","snapshot_observed_at":"2026-07-06T22:30:26.679189Z","submitted_at":"2025-09-22T12:19:46Z","title":"GLo-MAPPO: Multi-Agent Deep Reinforcement Learning for Energy-Efficient UAV-Assisted LoRa Networks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T14:58:06.782237Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2509.17676"},"observation_digest":"sha256:495c43b5542f0980de5f6e9e1c59943b298088d7e261a76a6a01f48e09e42a2c","observation_id":"5c2ab09e-d822-4490-9eb9-f8159364714b","resolution":{"observed_at":"2026-05-18T15:01:32.085928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-04T00:21:00.300581Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.02304","last_updated":"2026-06-01T21:37:50Z","snapshot_observed_at":"2026-08-04T00:20:58.682125Z","submitted_at":"2025-11-04T06:37:36Z","title":"Automata-Conditioned Cooperative Multi-Agent Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T00:21:00.300581Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2511.02304"},"observation_digest":"sha256:16c57cf6f431d28e2436d1b863652676c46f33263b3571e99178ac27990fd31e","observation_id":"5f4b886c-90d3-46f5-a56e-cb66cfc3f0d8","resolution":{"observed_at":"2026-08-04T00:21:00.300581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T22:45:05.341279Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2511.09331","last_updated":"2026-07-11T16:56:25Z","snapshot_observed_at":"2026-08-08T04:18:01.543499Z","submitted_at":"2025-11-12T13:46:27Z","title":"CoRL-MPPI: Enhancing MPPI With Learnable Behaviours For Efficient And Provably-Safe Multi-Robot Collision Avoidance","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T22:45:05.341279Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2511.09331"},"observation_digest":"sha256:8b50e6818c27afe4795750e4cc9e6ec3dea754a6c496caf35c94cb1133de593b","observation_id":"6615f35e-7150-4c6a-9042-b68e5943707f","resolution":{"observed_at":"2026-08-03T22:45:05.341279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T09:47:47.051969Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:b36fe48a3ec49a72a324e68be6a6fe68edc671147a6fc27c246b273ac5848a78","observation_id":"b6741e5a-2b25-4477-aa15-168156f3a141","resolution":{"observed_at":"2026-05-16T09:50:49.388973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T06:46:38.714757Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:38.714757Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:64c7b4dc8ce76b66a6fdc5b838b305447995d01909836e5a502f103a2ed98090","observation_id":"24fd116b-8dd5-454b-8514-0d1b368a94c2","resolution":{"observed_at":"2026-08-03T06:46:38.714757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T07:41:48.634351Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:de07545de77f692448e0164acf373d880344be3b846d03e3cbb8be7406d3a83d","observation_id":"b14eaffc-0966-4b5b-9580-29998a472d35","resolution":{"observed_at":"2026-05-25T07:45:29.811527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T05:37:38.423388Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T05:37:38.423388Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:a85f1c45261763edee8a3b27cfad5889927643552c6e7e629466256dd96c663b","observation_id":"83b20bd7-556a-4f4e-b745-9a534703513d","resolution":{"observed_at":"2026-08-03T05:37:38.423388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-02T22:04:22.549456Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.18291","last_updated":"2026-06-10T06:44:26Z","snapshot_observed_at":"2026-08-08T14:33:06.351293Z","submitted_at":"2026-02-20T15:38:02Z","title":"Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T22:04:22.549456Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.18291"},"observation_digest":"sha256:49b9b3b0ae3d179b0635394a92cc6e53abdf40f02fd343476b51cec976d24f51","observation_id":"b05aa95b-e6cf-4be0-823d-dde141e83ccf","resolution":{"observed_at":"2026-08-02T22:04:22.549456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2604.17220","last_updated":"2026-06-02T11:51:14Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:03:25Z","title":"Dynamics of Cognitive Heterogeneity: Investigating Behavioral Biases in Multi-Stage Supply Chains with LLM-Based Simulation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T06:06:48.422940Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2604.17220"},"observation_digest":"sha256:c613b9685f60f2da5d120cd3509ac9d494f7249024b916024e0214270021e3cc","observation_id":"60db8146-90a8-4062-8d0a-46492b782f67","resolution":{"observed_at":"2026-05-10T06:11:20.592675Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2604.25972","last_updated":"2026-04-28T07:50:24Z","snapshot_observed_at":"2026-08-04T03:25:30.683039Z","submitted_at":"2026-04-28T07:50:24Z","title":"A Survey of Multi-Agent Deep Reinforcement Learning with Graph Neural Network-Based Communication","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:51:52.921851Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2604.25972"},"observation_digest":"sha256:682f2bd6de32e3b05d0019a783a96dedb6fc9d8ea522833e57c56c07e103d855","observation_id":"e038e97b-2a29-45bf-bc6e-7a28b318c74a","resolution":{"observed_at":"2026-05-11T23:31:15.706553Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.01865","last_updated":"2026-05-03T13:20:00Z","snapshot_observed_at":"2026-08-03T20:33:06.041689Z","submitted_at":"2026-05-03T13:20:00Z","title":"Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T19:35:39.458735Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.01865"},"observation_digest":"sha256:8d80f7f0b5db05b6de6bd12e6c27fe7174aa4eb4020d727523dccff2d6c52ff0","observation_id":"6c4fe843-9dfb-4b72-9bd5-19ac74c87580","resolution":{"observed_at":"2026-05-09T05:45:22.780858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.02801","last_updated":"2026-05-04T16:42:18Z","snapshot_observed_at":"2026-07-06T23:15:51.008483Z","submitted_at":"2026-05-04T16:42:18Z","title":"Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Traces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T18:44:27.685266Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.02801"},"observation_digest":"sha256:5f033b079c2163a473089f428aa53e7ee985755c701cb88756ee74848cc8dcb2","observation_id":"4290e2d3-909c-4b6a-b7ed-e1870042122d","resolution":{"observed_at":"2026-05-09T06:15:37.820927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04345","last_updated":"2026-05-05T23:07:09Z","snapshot_observed_at":"2026-08-05T05:38:51.263292Z","submitted_at":"2026-05-05T23:07:09Z","title":"Structural Equivalence and Learning Dynamics in Delayed MARL","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-08T17:14:48.299305Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04345"},"observation_digest":"sha256:7b1b9d78b801879c0f555639726f350b7a587ed59ff73bc4adff111da5d038bd","observation_id":"20c57cab-65df-4d84-8218-e63f0fbf767d","resolution":{"observed_at":"2026-05-11T17:46:07.709119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04741","last_updated":"2026-05-10T04:42:30Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:37:41Z","title":"Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T16:11:38.561963Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04741"},"observation_digest":"sha256:bbb2c8ad60d012868d58a7dc66028b13731d32deec7cb0d318a27c815c3b7aae","observation_id":"c38b668d-a53e-4f24-a17a-6a7b421a95c9","resolution":{"observed_at":"2026-05-11T18:21:09.388718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04741","last_updated":"2026-05-10T04:42:30Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:37:41Z","title":"Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:54:01.596020Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04741"},"observation_digest":"sha256:4c68ebe1853f18fa340003d47bc03f105a9035ca4bcbdd3ec8b0284e4fc0aa9f","observation_id":"75138870-8272-484a-9218-698e54175b46","resolution":{"observed_at":"2026-05-12T01:56:15.147649Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.06825","last_updated":"2026-05-07T18:27:15Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T18:27:15Z","title":"Randomness is sometimes necessary for coordination","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-11T01:01:38.215613Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.06825"},"observation_digest":"sha256:41a025109e80146904c68a9e3cab37aa28bbd9d8babb813c73d136585b417194","observation_id":"fc339639-4794-43a5-abd6-f2ba17a25203","resolution":{"observed_at":"2026-05-11T04:50:57.900648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T01:31:19.576223Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:a660e282f7ef35425c95501ed0fbeba485c12fecc406c6c8724d9568f317956d","observation_id":"c634d3e0-8393-4da6-b01f-ec8b39e57407","resolution":{"observed_at":"2026-05-12T07:56:27.404219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:46.440511Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:5595c02b6b49511dd6e4873c5f244a9f89ca324c89050fab0dd0edf97238e183","observation_id":"6de7d519-8b61-411f-84ff-47e02ec75580","resolution":{"observed_at":"2026-05-20T22:39:10.758260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.09212","last_updated":"2026-05-09T23:14:27Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T23:14:27Z","title":"Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-12T03:56:28.447136Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.09212"},"observation_digest":"sha256:c804e03917a9a1c8e9cdee2ff053cf1aac7882dee0f6691b56433464ca7be616","observation_id":"84cb4efb-6fab-4b5b-a452-3716599bcc6f","resolution":{"observed_at":"2026-05-12T06:51:27.893046Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.10482","last_updated":"2026-05-12T07:11:47Z","snapshot_observed_at":"2026-08-02T13:35:48.840118Z","submitted_at":"2026-05-11T12:43:25Z","title":"Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T05:07:19.011782Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.10482"},"observation_digest":"sha256:e9feb321dc86eeb6dd7206123dd9757f2ffc908bb2189eab10f589a0f8ad91c2","observation_id":"e698a5a8-1cdf-4f2f-b70c-e82f62831d62","resolution":{"observed_at":"2026-05-12T05:36:26.498975Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.10482","last_updated":"2026-05-12T07:11:47Z","snapshot_observed_at":"2026-08-02T13:35:48.840118Z","submitted_at":"2026-05-11T12:43:25Z","title":"Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T03:27:04.676218Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.10482"},"observation_digest":"sha256:f25c76230f394f27686f0a97c007e799d8a74a2b24f9023e70fde08567f7e97c","observation_id":"a5ad4a25-8ea7-4128-80c7-4f3953a11455","resolution":{"observed_at":"2026-05-13T03:27:11.260747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.11688","last_updated":"2026-05-12T07:46:03Z","snapshot_observed_at":"2026-07-31T18:15:17.654469Z","submitted_at":"2026-05-12T07:46:03Z","title":"Shaping Zero-Shot Coordination via State Blocking","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T07:42:23.260464Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.11688"},"observation_digest":"sha256:fc698948cb046477ba0f65769dce34a70760cd73183213b58c32907d0281c68b","observation_id":"a1ff86c5-aba8-4698-a5f5-b696f6578a49","resolution":{"observed_at":"2026-05-13T07:42:30.236738Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.12655","last_updated":"2026-06-10T15:03:44Z","snapshot_observed_at":"2026-07-06T23:24:18.302402Z","submitted_at":"2026-05-12T19:01:16Z","title":"Robust Instruction Compliance in Cooperative Multi-Agent Reinforcement Learning","version":3},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:35.277901Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.12655"},"observation_digest":"sha256:f2f85dffdfef2a2ac647b6da74827fc9553f67fcddc6d6da6ed705d764926cd8","observation_id":"f3a0ce6f-4c6b-4c7a-8d67-989fce7a2aa5","resolution":{"observed_at":"2026-06-30T22:15:05.787678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.19235","last_updated":"2026-05-19T01:07:39Z","snapshot_observed_at":"2026-08-03T12:43:59.750963Z","submitted_at":"2026-05-19T01:07:39Z","title":"GAE Falls Short in Imperfect-Information Self-Play Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T07:50:09.840762Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.19235"},"observation_digest":"sha256:f6ab09fe7d532220a7a549d6b75f79299c2a5fe9d2bc7a5ab3fa596ff607fa82","observation_id":"47dda601-d95f-42e7-995d-3a8ec4c1a790","resolution":{"observed_at":"2026-05-20T07:53:10.038170Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.20255","last_updated":"2026-05-25T19:49:33Z","snapshot_observed_at":"2026-07-31T01:34:30.871692Z","submitted_at":"2026-05-18T12:02:41Z","title":"Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T08:16:06.101467Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.20255"},"observation_digest":"sha256:b87f7c3038380824ddc95089db9aab12ea018b9bd358f8ccb8774de6d32356cc","observation_id":"d3c6a7a1-6985-41e2-873f-bc226bbff538","resolution":{"observed_at":"2026-05-21T08:19:52.576414Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.20255","last_updated":"2026-05-25T19:49:33Z","snapshot_observed_at":"2026-07-31T01:34:30.871692Z","submitted_at":"2026-05-18T12:02:41Z","title":"Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T18:41:15.177901Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.20255"},"observation_digest":"sha256:cf94a3b45b10152cd4411d6b7bb857591f549cd98227302c291704c4f3b4e76d","observation_id":"e3754cdb-3ace-4344-8be2-5eb1a42be905","resolution":{"observed_at":"2026-06-30T18:45:00.623817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.23562","last_updated":"2026-05-22T12:29:29Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:29:29Z","title":"ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T02:45:23.162374Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.23562"},"observation_digest":"sha256:dd88e2969c189526ab4af24b06ca6f0201f44e7b00755559e37badbd5ed588d5","observation_id":"83b36f02-d62c-4f55-8c06-2ed93933cb6c","resolution":{"observed_at":"2026-05-25T02:46:33.540674Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.23652","last_updated":"2026-05-22T14:04:43Z","snapshot_observed_at":"2026-08-02T06:13:06.501853Z","submitted_at":"2026-05-22T14:04:43Z","title":"One Policy, Infinite NPCs: Persona-Traceable Shared RL Policies for Scalable Game Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T04:08:01.237797Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.23652"},"observation_digest":"sha256:af139c30a40f5941aab9637dfbdd0fde7a24d742d488cac028865c59cdb21c31","observation_id":"add93690-0dcf-4584-90f2-b6e882e146c9","resolution":{"observed_at":"2026-05-25T04:10:19.524254Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-07-31T22:58:06.517022Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:c1b8217e0c15e3b0c7b5a17fc5d199ac0a8fa85af1a29a9b9ca49fe3a2c93b4a","observation_id":"25717b9d-3024-4e1f-be48-7c30eb504949","resolution":{"observed_at":"2026-07-02T22:07:25.850015Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.09958","last_updated":"2026-06-08T12:04:06Z","snapshot_observed_at":"2026-07-06T23:49:12.754871Z","submitted_at":"2026-06-08T12:04:06Z","title":"Uncertainty-Aware Motion Planning for Autonomous Driving in Mixed Traffic Environment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T16:20:28.917237Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.09958"},"observation_digest":"sha256:1b5759fa03fe9e3a1d0084cd92f0696873639c508434cad53af917ae488cbe8c","observation_id":"adc1b065-e8ad-42f1-a495-a8b85f0b62f7","resolution":{"observed_at":"2026-07-03T01:47:31.271184Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.13076","last_updated":"2026-06-11T08:59:41Z","snapshot_observed_at":"2026-08-01T07:46:46.244578Z","submitted_at":"2026-06-11T08:59:41Z","title":"$\\alpha$-fair heterogeneous agent reinforcement learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T05:15:10.298871Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.13076"},"observation_digest":"sha256:d35b0c03c51e23dfbe9b37909cc2f8b7cdb92375fcba17fe4fbf81cd86c6d56e","observation_id":"f258d79e-a570-4c29-b562-06bafb526b94","resolution":{"observed_at":"2026-06-27T05:20:35.875559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-13T07:38:02.368884Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.14130","last_updated":"2026-07-09T21:57:35Z","snapshot_observed_at":"2026-08-07T13:26:36.549061Z","submitted_at":"2026-06-12T05:30:53Z","title":"Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T07:38:02.368884Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.14130"},"observation_digest":"sha256:fedf3c0ad2db35eaf34193ef53776e67bcfd973a78b28e71aefa432c0a953cee","observation_id":"0b2e67d2-63d4-4938-9fee-6a1bfda13a8b","resolution":{"observed_at":"2026-07-13T07:38:02.368884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.25526","last_updated":"2026-06-24T08:05:11Z","snapshot_observed_at":"2026-08-07T08:43:32.910783Z","submitted_at":"2026-06-24T08:05:11Z","title":"Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T21:17:28.832301Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.25526"},"observation_digest":"sha256:a2c3696383125f5883bb4a710c4916f82bbf46e82b4775917dbed669d30e3744","observation_id":"ef5355c4-7fd3-44a2-91fb-08055c8b5910","resolution":{"observed_at":"2026-07-04T19:30:07.596579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.29126","last_updated":"2026-07-01T12:24:28Z","snapshot_observed_at":"2026-08-06T07:56:41.735953Z","submitted_at":"2026-06-28T00:29:12Z","title":"HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T07:58:50.823587Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.29126"},"observation_digest":"sha256:995e8d5cfc5dc032d65a1e941621555878c0cddae80404d110e3042a43f29b9e","observation_id":"347de482-8002-400c-83e8-a35140fdc7c7","resolution":{"observed_at":"2026-06-30T08:04:28.210847Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.29126","last_updated":"2026-07-01T12:24:28Z","snapshot_observed_at":"2026-08-06T07:56:41.735953Z","submitted_at":"2026-06-28T00:29:12Z","title":"HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-02T20:54:45.339382Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.29126"},"observation_digest":"sha256:33fbeb18d45a9b819e9d324741f1741ccb7c9483b20cddfd6fef58f6ea9d1faf","observation_id":"2d7aaac3-d058-4123-9638-4b946932fc9f","resolution":{"observed_at":"2026-07-02T20:57:22.693570Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2607.00324","last_updated":"2026-07-01T01:50:04Z","snapshot_observed_at":"2026-08-04T22:32:05.118839Z","submitted_at":"2026-07-01T01:50:04Z","title":"Queue-Aware Graph Reinforcement Learning for UAV-ISAC-Assisted Maritime Data Collection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-02T00:50:38.051501Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.00324"},"observation_digest":"sha256:25812957078df6f4661e4e248080ea6378641c997ac0c6ea3f93e4e226fd9cb6","observation_id":"cfec2997-ff53-495a-abba-cdb0ea09d976","resolution":{"observed_at":"2026-07-02T00:56:24.158913Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b5458c4ce06b192264de5df11ab6cf37e3dc1779ce4371e7a92b3fb94c1edd74","observation_id":"779a09df-d05f-4cf1-a990-836252a614ad","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-02T04:50:33.029683Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13591","last_updated":"2026-07-15T08:32:40Z","snapshot_observed_at":"2026-08-06T21:05:54.197003Z","submitted_at":"2026-07-15T08:32:40Z","title":"Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T04:50:33.029683Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.13591"},"observation_digest":"sha256:83a7c4928e43f7157d2771db443449b18092dc664c973117cf012a5a945a20cf","observation_id":"4c22faf1-3755-4a3d-93d9-02b132b4cc65","resolution":{"observed_at":"2026-08-02T04:50:33.029683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-01T16:42:02.462350Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-05T19:18:08.693546Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.462350Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:2a611780ee34fbfb3874187da4fbe3800df2621b41182f30fd0a10ad8b7f7aa7","observation_id":"dfb80bfe-04ff-4c44-bc48-6d234cb14935","resolution":{"observed_at":"2026-08-01T16:42:02.462350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-01T11:44:45.826996Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.19809","last_updated":"2026-07-22T06:42:03Z","snapshot_observed_at":"2026-08-04T13:40:04.589704Z","submitted_at":"2026-07-22T06:42:03Z","title":"Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:44:45.826996Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.19809"},"observation_digest":"sha256:9f32fa1e3d91d97db80d7e830862efdf6e8bec7bd772d565a7f878b46c7460a5","observation_id":"bd66d22c-d191-46c2-ada4-64c274546c7d","resolution":{"observed_at":"2026-08-01T11:44:45.826996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T15:25:39.361593Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-07T23:12:14.215199Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:39.361593Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:51d54f3c9f70ebb7f604882bdf27e5d9a7d7f1a665a57b733f230d7170924b01","observation_id":"de330224-ef15-4bcc-8a3e-3386950808e0","resolution":{"observed_at":"2026-08-05T15:25:39.361593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2011.09533/citation-record","integrity":"/paper/2011.09533/integrity","json":"/paper/2011.09533/citation-record.json","paper":"/paper/2011.09533"},"outbound":[],"paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 64 inbound Pith citation observations for arXiv:2011.09533."}