{"as_of":"2026-08-09T16:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:009748ce4a9f83753afd57bf084ef75ec111b0273fa584350d25b4b2f00a6b2d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":63,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:54:06.524627Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.613613Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"1907.09467","last_updated":"2019-07-20T05:13:53Z","snapshot_observed_at":"2026-07-06T08:09:23.168454Z","submitted_at":"2019-07-20T05:13:53Z","title":"Arena: a toolkit for Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T18:35:31.633881Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/1907.09467"},"observation_digest":"sha256:b2c4a1a2ecddc1db7e7567480e38111fc38483c18c8b17a946e871518a8c5b46","observation_id":"39e91012-e2a6-485f-b63d-344279a0fbc2","resolution":{"observed_at":"2026-05-24T18:36:19.039203Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2404.10976","last_updated":"2026-04-10T00:30:36Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T01:17:10Z","title":"Group-Aware Coordination Graph for Multi-Agent Reinforcement Learning","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-24T02:18:32.308551Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2404.10976"},"observation_digest":"sha256:d3f7c3dc025fee84229b691d6550f6f6abf39b1bc48c788b93ccc543457f2228","observation_id":"284ff8e2-15cf-4a6a-bf1c-96c88f797993","resolution":{"observed_at":"2026-05-24T02:18:44.775808Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2502.02844","last_updated":"2025-06-18T06:49:09Z","snapshot_observed_at":"2026-07-06T20:31:17.809419Z","submitted_at":"2025-02-05T02:59:23Z","title":"Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T03:24:33.788346Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.02844"},"observation_digest":"sha256:3c00c5cc1a2084d91e16ffcfe5802b5a262571237401cb027a2ce4e59f57e0db","observation_id":"0eb12ab9-d1e3-4523-9fa6-f5f09fd462bc","resolution":{"observed_at":"2026-05-23T03:25:20.389635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-09T05:54:06.524627Z","title":"The starcraft multi-agent challenge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.03125","last_updated":"2025-02-05T12:31:55Z","snapshot_observed_at":"2026-08-09T05:47:56.856313Z","submitted_at":"2025-02-05T12:31:55Z","title":"Double Distillation Network for Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T05:54:06.524627Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.03125"},"observation_digest":"sha256:ccd6a2aa9750087367e3b4fe0b12ff128b18612166aa2651f6f17980a49e6693","observation_id":"b5b26b8c-dd7d-4921-ac1f-8fa888b00e75","resolution":{"observed_at":"2026-08-09T05:54:06.524627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-09T05:02:13.291676Z","title":"The starcraft multi-agent challenge","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.03369","last_updated":"2025-02-05T17:07:37Z","snapshot_observed_at":"2026-08-09T12:36:37.004381Z","submitted_at":"2025-02-05T17:07:37Z","title":"Learning from Active Human Involvement through Proxy Value Propagation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T05:02:13.291676Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.03369"},"observation_digest":"sha256:a04469d51759b2e5a1b8dda5d1e9df150e3ca0ef47409b52ec47e468f57e7335","observation_id":"43b7a1ab-eb22-4dd8-92f6-0e5c6ad147e6","resolution":{"observed_at":"2026-08-09T05:02:13.291676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2502.03506","last_updated":"2026-05-04T09:30:33Z","snapshot_observed_at":"2026-07-06T20:31:50.759186Z","submitted_at":"2025-02-05T12:06:54Z","title":"Optimistic {\\epsilon}-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T04:16:54.807723Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.03506"},"observation_digest":"sha256:1fe6732db6cf461b97b77dbcdf1970c60a7e6100c6de031cdbd655b0d864ed55","observation_id":"5e9f1047-0c1b-4787-80cc-b805414b23a1","resolution":{"observed_at":"2026-05-23T04:17:30.922080Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-09T00:36:02.756885Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.03845","last_updated":"2025-02-06T07:55:24Z","snapshot_observed_at":"2026-08-09T00:28:54.422167Z","submitted_at":"2025-02-06T07:55:24Z","title":"PAGNet: Pluggable Adaptive Generative Networks for Information Completion in Multi-Agent Communication","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T00:36:02.756885Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.03845"},"observation_digest":"sha256:120333d439f860e42df8c7423d2f28554719e94545a71a10437206819749a070","observation_id":"02cc4699-4e89-4fc7-8b34-6dc68c7969ea","resolution":{"observed_at":"2026-08-09T00:36:02.756885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-08T21:35:36.392136Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.04773","last_updated":"2025-07-03T18:43:16Z","snapshot_observed_at":"2026-08-08T21:28:59.079762Z","submitted_at":"2025-02-07T09:17:02Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T21:35:36.392136Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.04773"},"observation_digest":"sha256:a59e52317295464bf0a944dad589f767d6192450997b6f8531e6dec8f5c627ca","observation_id":"791eaea7-6b6f-48b7-b47a-9166fc34e487","resolution":{"observed_at":"2026-08-08T21:35:36.392136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-08T18:50:49.863497Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05573","last_updated":"2025-02-08T13:57:53Z","snapshot_observed_at":"2026-08-09T08:31:49.330723Z","submitted_at":"2025-02-08T13:57:53Z","title":"Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T18:50:49.863497Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.05573"},"observation_digest":"sha256:a25195e8d31296505c6c3fae61335ab1482c81756de6cdd6ae508755ae6d6928","observation_id":"257e8abb-3686-4428-a0ae-01de21d44260","resolution":{"observed_at":"2026-08-08T18:50:49.863497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T23:14:16.504684Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.08950","last_updated":"2025-02-13T04:17:43Z","snapshot_observed_at":"2026-08-09T04:06:16.222993Z","submitted_at":"2025-02-13T04:17:43Z","title":"Single-Agent Planning in a Multi-Agent System: A Unified Framework for Type-Based Planners","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T23:14:16.504684Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.08950"},"observation_digest":"sha256:a222f00787bebc97148dabb825db002166c6baad18663d51f43d762470c168a2","observation_id":"c1ee0937-98a4-4b67-8e05-ba468c39f13a","resolution":{"observed_at":"2026-08-07T23:14:16.504684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T20:39:51.742369Z","title":"Samvelyan, T","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.09762","last_updated":"2025-05-02T10:33:06Z","snapshot_observed_at":"2026-08-07T20:31:50.177588Z","submitted_at":"2025-02-13T20:45:48Z","title":"AT-Drone: Benchmarking Adaptive Teaming in Multi-Drone Pursuit","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T20:39:51.742369Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2502.09762"},"observation_digest":"sha256:5156433fba2f73ccdeb5e8fade6417d8591ed3a92e2e203ba86557ff387868b2","observation_id":"3457c812-1931-411a-8efd-88b8c4daf435","resolution":{"observed_at":"2026-08-07T20:39:51.742369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T14:16:46.575546Z","title":"H.,Foerster, J.andWhiteson, S.(2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19481","last_updated":"2025-05-26T04:03:48Z","snapshot_observed_at":"2026-08-09T06:39:07.678380Z","submitted_at":"2025-05-26T04:03:48Z","title":"Win Fast or Lose Slow: Balancing Speed and Accuracy in Latency-Sensitive Decisions of LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:46.575546Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2505.19481"},"observation_digest":"sha256:41d4567a22e179bf55572ed16f9d335d9a8a7a7004b5a9db5ea4284a0285c6ce","observation_id":"69770212-85d2-4c43-9cde-adfd7935c680","resolution":{"observed_at":"2026-08-07T14:16:46.575546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T14:10:43.252614Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-08T18:53:17.848101Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.252614Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:b8130895664aa7f40e2e331affbf87742070d88919c953b2dc33c0522b43b97a","observation_id":"92c7db2b-d470-4bae-89d4-e589f727fc66","resolution":{"observed_at":"2026-08-07T14:10:43.252614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T13:10:24.777756Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.22781","last_updated":"2025-05-28T18:50:25Z","snapshot_observed_at":"2026-08-08T05:00:44.050132Z","submitted_at":"2025-05-28T18:50:25Z","title":"Finite-Sample Convergence Bounds for Trust Region Policy Optimization in Mean-Field Games","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T13:10:24.777756Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2505.22781"},"observation_digest":"sha256:62eaf5811b7bf3cec76845e29132deb66d6683cd6a6e74bcbe96eef1e3bd1dbb","observation_id":"a06817dc-94c0-40e9-b3b1-aced4a8a7c3e","resolution":{"observed_at":"2026-08-07T13:10:24.777756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T12:09:12.878586Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.00797","last_updated":"2025-06-01T02:58:20Z","snapshot_observed_at":"2026-08-07T11:55:24.070886Z","submitted_at":"2025-06-01T02:58:20Z","title":"Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.878586Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.00797"},"observation_digest":"sha256:486bc694a4d57c46f1a504e262197ab60e5d9a87fbfda25cccc6a3cb5078b064","observation_id":"e963249d-7e11-47ae-b019-9e3359cf0bd2","resolution":{"observed_at":"2026-08-07T12:09:12.878586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2506.02387","last_updated":"2026-04-13T08:26:12Z","snapshot_observed_at":"2026-08-04T07:16:14.991803Z","submitted_at":"2025-06-03T02:57:38Z","title":"VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-19T11:57:08.314088Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.02387"},"observation_digest":"sha256:c3f986dbb385f6c1be2b47974d9d6a47d5fc383ac56175de2c3f4552902ce661","observation_id":"afac9e65-3dd0-4a7c-a5a1-7f4bb1fad6d0","resolution":{"observed_at":"2026-05-19T11:57:16.298923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2506.07548","last_updated":"2026-05-06T13:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T08:38:18Z","title":"Overcoming Environmental Meta-Stationarity in MARL via Adaptive Curriculum and Counterfactual Group Advantage","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:51.426575Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.07548"},"observation_digest":"sha256:0cba3f826df9af21bfb9bafb0a02188d9eb658aa470700a41588a286fd2d09bd","observation_id":"ecc5c207-bda1-405e-96f9-fc50c19aaaeb","resolution":{"observed_at":"2026-05-19T11:12:15.527732Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T00:23:07.922367Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.14164","last_updated":"2025-06-17T03:57:28Z","snapshot_observed_at":"2026-08-09T13:35:55.205596Z","submitted_at":"2025-06-17T03:57:28Z","title":"Light Aircraft Game : Basic Implementation and training results analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:07.922367Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.14164"},"observation_digest":"sha256:755e5316274ff804a99ce05751267111ac29d6ae466da7fd4d77c126fd72965c","observation_id":"40197884-7218-4cbc-9eda-ab5aeab03682","resolution":{"observed_at":"2026-08-07T00:23:07.922367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T00:16:45.835286Z","title":"The starcraft multi-agent challenge.arXiv preprint arXiv:1902.04043, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.14990","last_updated":"2026-06-18T15:11:38Z","snapshot_observed_at":"2026-08-07T11:55:17.356594Z","submitted_at":"2025-06-17T21:50:04Z","title":"MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:16:45.835286Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.14990"},"observation_digest":"sha256:08432d94651e9e71e000a2f52e1e98c530455a8fd4b44d5060b7c480330e3faa","observation_id":"fe880bbb-6615-47ed-b8f3-1c3c36d30eb5","resolution":{"observed_at":"2026-08-07T00:16:45.835286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2506.19417","last_updated":"2026-05-11T20:15:11Z","snapshot_observed_at":"2026-07-06T21:46:48.149083Z","submitted_at":"2025-06-24T08:35:15Z","title":"Focusing Influence Mechanism for Multi-Agent Reinforcement Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-19T07:16:37.438901Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.19417"},"observation_digest":"sha256:47ffb566b8ba06d79d2390136544b8386da2f163cbc7a70984136bfb236a4f61","observation_id":"a18f12c5-0726-4c6e-8f19-7a0886f2bcf2","resolution":{"observed_at":"2026-05-19T07:17:08.324849Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T23:02:24.663940Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.663940Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:33d49515c9e392431f2ea3090445c64baa09a8bccf4879bf05e4b7cd35e984a6","observation_id":"bc81f89e-a19b-4baf-ac9f-ab4709027df4","resolution":{"observed_at":"2026-08-06T23:02:24.663940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T20:59:15.116702Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.01470","last_updated":"2025-07-02T08:33:03Z","snapshot_observed_at":"2026-08-08T06:47:26.631798Z","submitted_at":"2025-07-02T08:33:03Z","title":"Zero-Incentive Dynamics: a look at reward sparsity through the lens of unrewarded subgoals","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:59:15.116702Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.01470"},"observation_digest":"sha256:53ae78162568fff04f0f4eb860b5022992d0bfa7ebf169a6f7d1e47d3b244e3a","observation_id":"3724e73d-6be2-4af4-8957-7a144c55dbcc","resolution":{"observed_at":"2026-08-06T20:59:15.116702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T19:17:11.193353Z","title":"The starcraft multi-agent challenge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06004","last_updated":"2025-07-08T14:07:53Z","snapshot_observed_at":"2026-08-07T08:46:11.836572Z","submitted_at":"2025-07-08T14:07:53Z","title":"From General Relation Patterns to Task-Specific Decision-Making in Continual Multi-Agent Coordination","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:17:11.193353Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.06004"},"observation_digest":"sha256:ffa2ea3a0851a5a1964c6f325b2a1937e719736bdf6d720c135ebdcd26521c1e","observation_id":"79a94b4d-7fc6-4bd3-a3b5-763891662f2d","resolution":{"observed_at":"2026-08-06T19:17:11.193353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T18:58:35.903637Z","title":"John Schulman, Filip Wolski, Prafulla Dhariwal, Alec Radford, and Oleg Klimov","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.06825","last_updated":"2025-07-10T09:28:09Z","snapshot_observed_at":"2026-08-08T05:15:59.689599Z","submitted_at":"2025-07-09T13:15:05Z","title":"Artificial Generals Intelligence: Mastering Generals.io with Reinforcement Learning","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T18:58:35.903637Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.06825"},"observation_digest":"sha256:be6b0b5ece42fc726bdab4fc5d9ef17d3fb0f555be31e2a5748fbf3fd4acce7c","observation_id":"48c7d419-b193-43aa-9759-d9236b8224f5","resolution":{"observed_at":"2026-08-06T18:58:35.903637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T18:43:23.443674Z","title":"arXiv preprint arXiv:1902.04043 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07445","last_updated":"2026-06-28T16:34:15Z","snapshot_observed_at":"2026-08-09T11:23:03.691659Z","submitted_at":"2025-07-10T05:48:28Z","title":"StarDojo: Benchmarking Open-Ended Behaviors of Agentic Multimodal LLMs in Production-Living Simulations with Stardew Valley","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:43:23.443674Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.07445"},"observation_digest":"sha256:215f1cc1930663dd1f9c7330ffa6033878805139b4678c71ef0f17894de1dfa5","observation_id":"1ba737ca-6aef-4d50-b7e0-b265ad8f5dea","resolution":{"observed_at":"2026-08-06T18:43:23.443674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T17:57:08.618710Z","title":"The starcraft multi-agent challenge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":132,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.618710Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:bb6bba9eefa9d48adde04f46d1ac7cdfb6c3cc4558d4d4649aabdd25f9879ebf","observation_id":"c8538fe2-3663-4873-becf-c54e88cdf54f","resolution":{"observed_at":"2026-08-06T17:57:08.618710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T17:42:56.131650Z","title":"The starcraft multi-agent challenge.arXiv preprint arXiv:1902.04043, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.10142","last_updated":"2026-07-22T04:23:01Z","snapshot_observed_at":"2026-08-07T20:29:46.771527Z","submitted_at":"2025-07-14T10:39:17Z","title":"Toward Adaptable Multi-Agent Reinforcement Learning: An Assumption-Aware Review","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:56.131650Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.10142"},"observation_digest":"sha256:8dcb09f0841c0eb46c91843e43e1e7df5636e7232f7af61269e18e3a7c795eeb","observation_id":"e9bd22fd-2bb8-446d-990b-08be171f2651","resolution":{"observed_at":"2026-08-06T17:42:56.131650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T12:38:48.099267Z","title":"Neil Savage","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.21638","last_updated":"2026-07-21T11:06:56Z","snapshot_observed_at":"2026-08-06T12:38:42.232623Z","submitted_at":"2025-07-29T09:49:11Z","title":"Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T12:38:48.099267Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.21638"},"observation_digest":"sha256:e526f2ecbda70cf6391a9b7cafa6cad5ce1a9451595fc6e12aee94d6ccffd66a","observation_id":"ef66e1c3-d6dc-4a40-a18f-1987bb5038a1","resolution":{"observed_at":"2026-08-06T12:38:48.099267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T10:40:38.849091Z","title":"The starcraft multi-agent challenge.arXiv preprint arXiv:1902.04043, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.23604","last_updated":"2026-06-30T11:26:47Z","snapshot_observed_at":"2026-08-07T03:53:17.805976Z","submitted_at":"2025-07-31T14:42:12Z","title":"Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T10:40:38.849091Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.23604"},"observation_digest":"sha256:660974bed3fefdf4f330dcdb058e8686f27116b57ae23074f93cbeef21664410","observation_id":"600f0899-3509-4790-b3be-85fc39f1eaa4","resolution":{"observed_at":"2026-08-06T10:40:38.849091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-05T20:30:30.115627Z","title":"S.; Farquhar, G.; Nardelli, N.; Rudner, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10428","last_updated":"2025-08-14T07:58:01Z","snapshot_observed_at":"2026-08-07T15:44:58.934924Z","submitted_at":"2025-08-14T07:58:01Z","title":"SC2Arena and StarEvolve: Benchmark and Self-Improvement Framework for LLMs in Complex Decision-Making Tasks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T20:30:30.115627Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2508.10428"},"observation_digest":"sha256:f1928d1e2dd5d955e3e6200f334dd94604795779da308b80491a15e7934cb121","observation_id":"0fb317f2-1174-470a-a596-89e4fb743e01","resolution":{"observed_at":"2026-08-05T20:30:30.115627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-05T14:49:53.303698Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2508.20818","last_updated":"2025-08-28T14:16:17Z","snapshot_observed_at":"2026-08-07T17:56:45.782981Z","submitted_at":"2025-08-28T14:16:17Z","title":"cMALC-D: Contextual Multi-Agent LLM-Guided Curriculum Learning with Diversity-Based Context Blending","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T14:49:53.303698Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2508.20818"},"observation_digest":"sha256:ebd7b99ffa05a6d1a395ec06ce3b70f31d19043253ea98862587ce778b22c454","observation_id":"3c993876-5d60-4289-a74a-7c76678fc352","resolution":{"observed_at":"2026-08-05T14:49:53.303698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-05T10:51:55.765630Z","title":"The StarCraft multi -agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.765630Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:742158bbb9173b83627878d37596ee9558462f9e9d18bf81d0b5f3abb812ec05","observation_id":"5306b4e4-2b89-4618-b7ec-3ee871a64e7c","resolution":{"observed_at":"2026-08-05T10:51:55.765630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-04T23:58:45.783516Z","title":"The StarCraft Multi-Agent Challenge","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2509.06235","last_updated":"2025-09-07T22:51:12Z","snapshot_observed_at":"2026-08-09T10:09:57.218826Z","submitted_at":"2025-09-07T22:51:12Z","title":"PillagerBench: Benchmarking LLM-Based Agents in Competitive Minecraft Team Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:58:45.783516Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.06235"},"observation_digest":"sha256:e7df4d95261062c674d3756a903d9a3390cc3d375fd097e48edf8bcdd9a657bd","observation_id":"dae82299-ddee-404e-9759-ccb29770d2fb","resolution":{"observed_at":"2026-08-04T23:58:45.783516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-04T17:49:15.036493Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.10656","last_updated":"2026-07-05T23:05:41Z","snapshot_observed_at":"2026-08-08T12:41:14.961784Z","submitted_at":"2025-09-12T19:35:20Z","title":"Self-Supervised Goal-Reaching Results in Multi-Agent Cooperation and Exploration","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T17:49:15.036493Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.10656"},"observation_digest":"sha256:549e0b5e5f679391cda0b9c05a821f96f369983bbe4806fd277da6f4c5e8fa74","observation_id":"96a1ab45-e253-4f3b-8e81-698add98763f","resolution":{"observed_at":"2026-08-04T17:49:15.036493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2509.15519","last_updated":"2026-05-09T02:35:26Z","snapshot_observed_at":"2026-08-07T04:21:28.912365Z","submitted_at":"2025-09-19T01:52:44Z","title":"Fully Decentralized Cooperative Multi-Agent Reinforcement Learning is A Context Modeling Problem","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-18T15:15:26.114479Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.15519"},"observation_digest":"sha256:65792c0e1a662a28ef57aa5ebc27b73fb928b97afed4b64f7b37304655fef429","observation_id":"2244432f-dd46-46f0-81db-08e69517363e","resolution":{"observed_at":"2026-05-18T15:16:32.282503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:a808fe82abe138795a3e3cbdbb4abaca1909d906e25623c4aa6d3053e2b49568","observation_id":"c6b7d9f4-8577-469a-bbbc-eaf44d491776","resolution":{"observed_at":"2026-05-14T23:13:15.710370Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T07:41:48.634351Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:dff50949223cfb1f5588eaea365ca23cc7983d7420cf35f70b259a16831a09b3","observation_id":"0787dc86-5d0d-4bc9-a240-30d91f99c5ac","resolution":{"observed_at":"2026-05-25T07:45:29.787490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-03T05:37:38.464277Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":4},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-03T05:37:38.464277Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:feb8e81588dbf9dd3784cd08e6cbd3c39689e3d215bb432b1d698edb3fb66a2b","observation_id":"d0261826-d566-40ab-8471-3e1d8d24f236","resolution":{"observed_at":"2026-08-03T05:37:38.464277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2604.08174","last_updated":"2026-04-09T12:31:43Z","snapshot_observed_at":"2026-07-06T22:57:18.202215Z","submitted_at":"2026-04-09T12:31:43Z","title":"Value-Guidance MeanFlow for Offline Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:50:51.653571Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2604.08174"},"observation_digest":"sha256:65258f15e7c58afd81f5cf026a09183f6f9add116afbf94ad26509e2ef77fff4","observation_id":"998ad793-1996-41c2-813e-3345858c916a","resolution":{"observed_at":"2026-05-11T08:05:58.890142Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2604.08728","last_updated":"2026-04-09T19:42:17Z","snapshot_observed_at":"2026-07-06T22:57:45.084987Z","submitted_at":"2026-04-09T19:42:17Z","title":"Wireless Communication Enhanced Value Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T17:01:35.037646Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2604.08728"},"observation_digest":"sha256:4d4e0772cbfa788779a57a998b84415558317f084658d8f1f4256aa70a36b98d","observation_id":"86872182-772a-4be0-a1e8-ee08bae212b7","resolution":{"observed_at":"2026-05-11T07:41:01.310875Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2604.22452","last_updated":"2026-04-24T11:11:36Z","snapshot_observed_at":"2026-07-06T23:08:51.913995Z","submitted_at":"2026-04-24T11:11:36Z","title":"Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-08T12:00:07.345611Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2604.22452"},"observation_digest":"sha256:c010d591615915fbe331ffd32bb9fb9ceeb6a13732263bd17d6e8a6c9dd8bdac","observation_id":"9331e6ad-6ac9-4f07-a09a-3efc9299d84f","resolution":{"observed_at":"2026-05-11T19:26:08.787056Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2604.27162","last_updated":"2026-04-29T20:09:13Z","snapshot_observed_at":"2026-07-06T23:12:38.453388Z","submitted_at":"2026-04-29T20:09:13Z","title":"A High-Throughput Compute-Efficient POMDP Hide-And-Seek-Engine (HASE) for Multi-Agent Operations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T10:27:55.337253Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2604.27162"},"observation_digest":"sha256:13ce44ffb0b13156ef657c584a194cc4845f9ab1887c41f6f8d0ccd5d8cc961b","observation_id":"2a7b9eee-34b2-4caa-ab47-d3ff6bd9e092","resolution":{"observed_at":"2026-05-12T09:36:26.196097Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.01457","last_updated":"2026-05-13T01:42:20Z","snapshot_observed_at":"2026-08-02T14:59:41.829405Z","submitted_at":"2026-05-02T14:12:04Z","title":"CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T14:29:18.385955Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.01457"},"observation_digest":"sha256:7faf46346ab78294caa24a1787533e3a7a4ee7731bdb6f543a0d086b74d8d7b0","observation_id":"24d67899-6ecb-427b-9f4f-d3a376f8c767","resolution":{"observed_at":"2026-05-11T16:56:07.283260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.01457","last_updated":"2026-05-13T01:42:20Z","snapshot_observed_at":"2026-08-02T14:59:41.829405Z","submitted_at":"2026-05-02T14:12:04Z","title":"CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T07:26:08.192587Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.01457"},"observation_digest":"sha256:3b97cffa63369da5e0990923933d5c19f6ebc5d1b1af96ed85db440722bde700","observation_id":"fde79c3c-229b-4d17-92da-b7e8025aef56","resolution":{"observed_at":"2026-05-13T07:27:29.622030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.01457","last_updated":"2026-05-13T01:42:20Z","snapshot_observed_at":"2026-08-02T14:59:41.829405Z","submitted_at":"2026-05-02T14:12:04Z","title":"CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T21:28:28.236225Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.01457"},"observation_digest":"sha256:ce7a396d92f86c7c3801bc71d032aed989cd9f8d1b1d4cb28f2ef92bd30988bb","observation_id":"caf11c4b-3005-45a3-9645-5209139721e8","resolution":{"observed_at":"2026-05-14T21:29:28.805783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.08131","last_updated":"2026-05-01T05:01:10Z","snapshot_observed_at":"2026-07-06T23:20:24.341928Z","submitted_at":"2026-05-01T05:01:10Z","title":"Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T00:50:35.026779Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.08131"},"observation_digest":"sha256:da609a21081979e5dc3ef7d6114b0fb601e2f5e8b94570dda8399e2dd40f8106","observation_id":"3141423a-4945-4eac-bc25-b40284f0b65b","resolution":{"observed_at":"2026-05-12T00:51:14.843828Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T01:31:19.576223Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:852e0c81f1cd725983d9f80b79a2d9e4387b0aa2936fa69269051d02d8bd2395","observation_id":"d5b27676-c461-4702-b8d7-452b5b790a6f","resolution":{"observed_at":"2026-05-12T07:56:27.332574Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:46.440511Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:7fb05ca721d58492cbc3a413e405e2fe66dcc0a4bad9a5ef8039d182e91439a1","observation_id":"6a77c3c6-f53b-4096-a534-22edce3e9223","resolution":{"observed_at":"2026-05-20T22:39:10.823818Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.08761","last_updated":"2026-05-09T07:47:07Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:47:07Z","title":"Beyond the All-in-One Agent: Benchmarking Role-Specialized Multi-Agent Collaboration in Enterprise Workflows","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T03:41:40.370052Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.08761"},"observation_digest":"sha256:5ed4fdb30679b196dd4c78b0f4a3ad4239a16e4537634c8bc691cd1ea82b9e3f","observation_id":"e2300159-f291-4617-a1de-5847ee34bd17","resolution":{"observed_at":"2026-05-12T07:06:37.826663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.15400","last_updated":"2026-05-14T20:34:16Z","snapshot_observed_at":"2026-08-05T22:05:46.469006Z","submitted_at":"2026-05-14T20:34:16Z","title":"Beyond Partner Diversity: An Influence-Based Team Steering Framework for Zero-Shot Human-Machine Teaming","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T15:27:22.127896Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.15400"},"observation_digest":"sha256:be5b5f050d95f5011e94d285bb376e3f1ffce251dda6b178a88f2d0a615ccd9e","observation_id":"91b12c73-6ffd-4515-85f2-e0d76eb6bb4f","resolution":{"observed_at":"2026-05-19T15:27:38.640395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.18024","last_updated":"2026-05-29T10:46:49Z","snapshot_observed_at":"2026-08-02T13:13:12.078195Z","submitted_at":"2026-05-18T08:14:38Z","title":"Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T12:23:11.320751Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.18024"},"observation_digest":"sha256:689bfce96eae9b87aa09bf4c95b548a8fca26db2abdfa934e1ee23f2c2284f17","observation_id":"88322232-2290-4bed-b9e5-7ea08614a113","resolution":{"observed_at":"2026-05-20T12:23:16.763125Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.18024","last_updated":"2026-05-29T10:46:49Z","snapshot_observed_at":"2026-08-02T13:13:12.078195Z","submitted_at":"2026-05-18T08:14:38Z","title":"Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T18:47:09.501908Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.18024"},"observation_digest":"sha256:b309957316c43fd0b169d3affaa698bc4274d8e16292af717bb3cb8d7d7532bb","observation_id":"cd91a27e-7eb2-4d1f-b01f-796541f7b85f","resolution":{"observed_at":"2026-06-30T18:55:00.840620Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.18591","last_updated":"2026-08-03T00:43:51Z","snapshot_observed_at":"2026-08-06T23:24:40.850221Z","submitted_at":"2026-05-18T16:05:36Z","title":"Randomized Advantage Transformation (RAT): Computing Natural Policy Gradients via Direct Backpropagation","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-05-20T12:44:29.147095Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.18591"},"observation_digest":"sha256:1657483651447780792458f0fdcf69018e3dda5168a5151c923e06fd4a9000f1","observation_id":"fb35782f-56fa-4cca-a410-c52663e1974c","resolution":{"observed_at":"2026-05-20T12:48:17.512475Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2605.23027","last_updated":"2026-05-21T20:50:47Z","snapshot_observed_at":"2026-07-06T23:33:19.375527Z","submitted_at":"2026-05-21T20:50:47Z","title":"PIMbot: A Self-Adaptive Attack Framework for Adversarial Manipulation of Multi-Robot Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-25T05:26:22.623367Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2605.23027"},"observation_digest":"sha256:b0e79ebe596acf6cdddc43f520de270969a0d5177d0decc74a74e73d2d6557d9","observation_id":"2b55a951-c3d2-470f-a251-26011fb763fa","resolution":{"observed_at":"2026-05-25T05:26:38.686813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.04492","last_updated":"2026-06-03T06:15:39Z","snapshot_observed_at":"2026-08-02T16:01:48.445974Z","submitted_at":"2026-06-03T06:15:39Z","title":"Episodic Memory Temporal Consistency for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T06:57:36.238274Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.04492"},"observation_digest":"sha256:1ecec001e55b1f96970e522ef3038d68eea5d4d9188b9a075fb2d43ef9204cb5","observation_id":"e6de946c-ea2d-4667-b43e-a097b14e3954","resolution":{"observed_at":"2026-07-02T07:26:45.890958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.11284","last_updated":"2026-06-09T16:40:26Z","snapshot_observed_at":"2026-08-03T21:53:08.877881Z","submitted_at":"2026-06-09T16:40:26Z","title":"Phi-Actor-Critic: Steering General-Sum Games to Pareto-Efficient Correlated Equilibria","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T10:42:17.852996Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.11284"},"observation_digest":"sha256:879d3b9931088987f7a0a3a7efe93a91b56db816c1ad651a1ab84489caed6981","observation_id":"7af2a22e-5a59-4af2-a01b-8dc27c6a6d73","resolution":{"observed_at":"2026-07-03T08:47:50.460561Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.12281","last_updated":"2026-06-10T16:20:18Z","snapshot_observed_at":"2026-08-04T00:42:02.326024Z","submitted_at":"2026-06-10T16:20:18Z","title":"CCKS: Consensus-based Communication and Knowledge Sharing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T07:33:50.358196Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.12281"},"observation_digest":"sha256:611674efa51ddf3502a6f19cec788cc6834dee88bee953cb984a18dd5e5a8a77","observation_id":"8bc1d099-97b3-445c-84d7-48b9a387282c","resolution":{"observed_at":"2026-07-03T13:48:20.891538Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.18308","last_updated":"2026-06-16T07:41:43Z","snapshot_observed_at":"2026-08-07T20:11:39.471918Z","submitted_at":"2026-06-16T07:41:43Z","title":"TRIDENT: Breaking the Hybrid-Safety-Physics Coupling for Provably Safe Multi-Agent Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-27T01:54:19.216553Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.18308"},"observation_digest":"sha256:be16bb43529a9ce3ae805153dd296f67ca3b4884d300aa5158b8f12228652b6b","observation_id":"174f807c-1309-479d-825b-eb1a14661109","resolution":{"observed_at":"2026-07-03T19:18:54.942471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.24601","last_updated":"2026-06-23T14:03:36Z","snapshot_observed_at":"2026-08-07T01:04:52.748978Z","submitted_at":"2026-06-23T14:03:36Z","title":"ASALT: Adaptive State Alignment for Lateral Transfer in Multi-agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-25T23:46:50.183064Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.24601"},"observation_digest":"sha256:faf1cc8fdc6dc8fc44734431f99611854ac4f92eef51486e381cb3690607a09a","observation_id":"e7571810-32ff-4db3-b13b-c10dd098412a","resolution":{"observed_at":"2026-07-04T17:20:00.541732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2606.25526","last_updated":"2026-06-24T08:05:11Z","snapshot_observed_at":"2026-08-07T08:43:32.910783Z","submitted_at":"2026-06-24T08:05:11Z","title":"Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-25T21:17:28.832301Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2606.25526"},"observation_digest":"sha256:f5e2f43fd461c37623f31fab55df0cb73e7a9368c856232c52e3f0cdbb16e13d","observation_id":"9395ea3d-2d17-4909-b2b8-ddebff0f6c08","resolution":{"observed_at":"2026-07-04T19:30:07.614931Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":"1902.04043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-07-04T19:30:07.613613Z","title":"S., Farquhar, G., Nardelli, N., Rudner, T","venue":null,"work_id":"2f26b259-cf76-40f3-b027-6946ef7763c8","year":1902},"citing_paper":{"arxiv_id":"2607.00190","last_updated":"2026-06-30T21:15:34Z","snapshot_observed_at":"2026-07-07T00:05:54.401681Z","submitted_at":"2026-06-30T21:15:34Z","title":"Play Like Champions: Counterfactual Feedback Generation in Latent Space","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-02T19:41:39.901829Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2607.00190"},"observation_digest":"sha256:fcf85de62e606374ce6cc00cd9610adfae257a3f7298739db75b0e9c469ea4a4","observation_id":"1b8c8b35-de31-45c9-b704-4af13e4c561e","resolution":{"observed_at":"2026-07-02T19:47:18.856152Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-01T14:36:00.853580Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.18719","last_updated":"2026-07-21T05:19:49Z","snapshot_observed_at":"2026-08-06T18:16:07.641481Z","submitted_at":"2026-07-21T05:19:49Z","title":"Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:36:00.853580Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2607.18719"},"observation_digest":"sha256:3ddac06d62a0c8e9438e4cc7277386f231b05cd1bdd873bb46de9b7b57388fd2","observation_id":"f29c1eb2-9923-48e6-9b69-b4c50c397dd7","resolution":{"observed_at":"2026-08-01T14:36:00.853580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-03T04:15:06.067394Z","title":"The starcraft multi-agent challenge.arXiv preprint arXiv:1902.04043,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.29577","last_updated":"2026-07-31T16:03:38Z","snapshot_observed_at":"2026-08-09T09:03:29.633669Z","submitted_at":"2026-07-31T16:03:38Z","title":"DungeonBench: A Benchmark for Rules-Rich Tactical Reasoning in Dungeons & Dragons Combat","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T04:15:06.067394Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2607.29577"},"observation_digest":"sha256:824b3003448e9d4ad05603e29808b1f3ca7e9ece6bbfe74b0c839b9001acfe8a","observation_id":"e7bac09c-82ec-40ea-aff7-408267d2403b","resolution":{"observed_at":"2026-08-03T04:15:06.067394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1902.04043/citation-record","integrity":"/paper/1902.04043/integrity","json":"/paper/1902.04043/citation-record.json","paper":"/paper/1902.04043"},"outbound":[],"paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 63 inbound Pith citation observations for arXiv:1902.04043."}