{"as_of":"2026-08-09T00:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eec4009451b462d2ddcdb631ca180779a754f682c41ec0cd55c8104dd17e082f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:34:33.681237Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:29:44.152952Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-08T21:34:33.681237Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.04788","last_updated":"2025-02-07T09:48:39Z","snapshot_observed_at":"2026-08-08T21:25:16.031165Z","submitted_at":"2025-02-07T09:48:39Z","title":"A non-zero-sum game with reinforcement learning under mean-variance framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T21:34:33.681237Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2502.04788"},"observation_digest":"sha256:8efbb1f6dbcecb337814f6db3300ec0468c944acf5b74cb0c7fb45dc89cbf1c4","observation_id":"5616e3e2-1e58-45f9-9625-d2212d1af8a4","resolution":{"observed_at":"2026-08-08T21:34:33.681237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-08T16:19:57.256137Z","title":"An overview of multi-agent reinforcement learning from game theoretical perspective","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.256137Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:c9b2b5dc63a5e1c4da1cc47937e4441863d7f385205ddd63b689877ceac4510c","observation_id":"c621892d-1268-4738-8b97-d31465cd2da1","resolution":{"observed_at":"2026-08-08T16:19:57.256137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-07T11:40:09.868243Z","title":"An overview of multi- agent reinforcement learning from game theoretical per- spective.arXiv preprint arXiv:2011.00583, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.01927","last_updated":"2025-06-02T17:45:58Z","snapshot_observed_at":"2026-08-07T11:28:57.275531Z","submitted_at":"2025-06-02T17:45:58Z","title":"Online Competitive Information Gathering for Partially Observable Trajectory Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:40:09.868243Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2506.01927"},"observation_digest":"sha256:c9666c400578112c2b4d5ad2817071b593efb73bb3ff7280b3ef0dcf85e5f0d9","observation_id":"3ef24ad3-e664-40b9-b56e-250c9a67d684","resolution":{"observed_at":"2026-08-07T11:40:09.868243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-07T05:27:42.394220Z","title":"An overview of multi-agent reinforcement learning from game theoretical perspective","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.08149","last_updated":"2025-06-09T18:56:40Z","snapshot_observed_at":"2026-08-07T10:01:44.083957Z","submitted_at":"2025-06-09T18:56:40Z","title":"Ego-centric Learning of Communicative World Models for Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:27:42.394220Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2506.08149"},"observation_digest":"sha256:473f8f34e0ca0e1ff4893f4807bd5523c8f1b614036dd9360aec2cac348d3113","observation_id":"7cf94762-5dcd-43ea-b174-e0f7a9998755","resolution":{"observed_at":"2026-08-07T05:27:42.394220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-06T20:39:08.673237Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02211","last_updated":"2025-07-04T13:32:01Z","snapshot_observed_at":"2026-08-08T17:12:40.067247Z","submitted_at":"2025-07-03T00:17:53Z","title":"Dilution, Diffusion and Symbiosis in Spatial Prisoner's Dilemma with Reinforcement Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T20:39:08.673237Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2507.02211"},"observation_digest":"sha256:159f462b691eba230a5dc3e9b0dfa22cdc265324feaa66ad4084e2907a5e1306","observation_id":"e7f07ed4-4bf4-4b1d-ab33-f0f1a927a2b2","resolution":{"observed_at":"2026-08-06T20:39:08.673237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-06T17:57:08.757441Z","title":"An overview of multi-agent reinforcement learning from game theoretical perspective","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09495","last_updated":"2025-07-13T05:02:43Z","snapshot_observed_at":"2026-08-06T23:14:57.681420Z","submitted_at":"2025-07-13T05:02:43Z","title":"GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective","version":1},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:08.757441Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2507.09495"},"observation_digest":"sha256:b6d44fe9744dd1f4435574d61f38f142a0bec4e9e8a6024bbef445f6693bafac","observation_id":"a2bfb1c4-9dc4-4e15-bb11-b730022e30fd","resolution":{"observed_at":"2026-08-06T17:57:08.757441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2509.15103","last_updated":"2026-05-12T02:18:50Z","snapshot_observed_at":"2026-08-03T14:49:01.635595Z","submitted_at":"2025-09-18T16:03:50Z","title":"Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T15:50:58.208995Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2509.15103"},"observation_digest":"sha256:cb85c05e953e3d28704f18f1ccec18f654e5698ab004beeb83ffb2095af45ed4","observation_id":"01f08913-1c6e-4b4d-91ad-4421eb8af822","resolution":{"observed_at":"2026-05-18T15:51:33.858683Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-04T15:51:50.162223Z","title":"An overview of multi-agent reinforce- ment learning from game theoretical perspective,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.18371","last_updated":"2026-06-23T15:24:05Z","snapshot_observed_at":"2026-08-05T14:47:27.738686Z","submitted_at":"2025-09-22T19:52:16Z","title":"Policy Gradient with Self-Attention for Model-Free Distributed Nonlinear Multi-Agent Games","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.162223Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2509.18371"},"observation_digest":"sha256:40f300cb8108966b9f127e045666526e8fdbec435c55307a759d72d7be478eb1","observation_id":"a2c906cc-a6cc-4f66-8dc8-5924c8b86544","resolution":{"observed_at":"2026-08-04T15:51:50.162223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-03T17:57:01.618808Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.07588","last_updated":"2026-07-17T17:54:02Z","snapshot_observed_at":"2026-08-04T02:40:01.160621Z","submitted_at":"2025-12-08T14:30:25Z","title":"An Agent-Centric Dynamical Systems Perspective on Multi-Agent Reinforcement Learning","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T17:57:01.618808Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2512.07588"},"observation_digest":"sha256:ee684eb169ae45da3f259843328d9207028a97d893fad3dffff6ffcac1ecaf4c","observation_id":"96f3b78f-c4f2-4554-91b1-3b91658cf73c","resolution":{"observed_at":"2026-08-03T17:57:01.618808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-03T03:21:02.658487Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.08566","last_updated":"2026-06-30T11:21:03Z","snapshot_observed_at":"2026-08-06T16:12:10.580807Z","submitted_at":"2026-02-09T12:04:55Z","title":"Homing through Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T03:21:02.658487Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2602.08566"},"observation_digest":"sha256:f638fd66365e5e7952fce96fecb21b8baed05044b928afaebf150454d0e74b95","observation_id":"901848d3-df23-40e7-9960-f293114ed597","resolution":{"observed_at":"2026-08-03T03:21:02.658487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-02T20:01:01.525082Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.00374","last_updated":"2026-06-25T19:26:06Z","snapshot_observed_at":"2026-08-07T15:30:24.601660Z","submitted_at":"2026-02-27T23:24:02Z","title":"Conservative Equilibrium Discovery in Offline Game-Theoretic Multiagent Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T20:01:01.525082Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2603.00374"},"observation_digest":"sha256:4a190964cc33147a71b53f70c3d25130d14fdd195b08dd261b48a7b650ca4f63","observation_id":"4dcfe501-143d-4e7a-b0e8-fbbfaac4707c","resolution":{"observed_at":"2026-08-02T20:01:01.525082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.07301","last_updated":"2026-05-08T06:11:42Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:11:42Z","title":"SOM: Structured Opponent Modeling for LLM-based Agents via Structural Causal Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T01:19:42.892343Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.07301"},"observation_digest":"sha256:4f0dacf583d25b9a1bde31504e0d48b89cad5e82189fbca7acc1af92b63e26d8","observation_id":"f8c4e402-110b-48a3-a674-fbc38a0b5302","resolution":{"observed_at":"2026-05-11T04:30:55.920669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.14193","last_updated":"2026-05-13T23:19:05Z","snapshot_observed_at":"2026-07-06T23:25:39.415637Z","submitted_at":"2026-05-13T23:19:05Z","title":"Equilibrium and Pricing in Consumer Networks with Nonlinear Utilities: An Online Shape-Constrained Learning Approach","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-15T01:44:55.089973Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.14193"},"observation_digest":"sha256:965ba005156b4a5d0906692e43f7073511f6e3e095a916a837db3535b59bc68a","observation_id":"6a34fac5-1089-4f72-8471-a28d675b9d56","resolution":{"observed_at":"2026-05-15T01:48:28.765815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.17189","last_updated":"2026-06-09T02:46:33Z","snapshot_observed_at":"2026-08-02T14:26:15.767422Z","submitted_at":"2026-05-16T23:10:10Z","title":"Sample-efficient inductive matrix completion with noise and inexact side-information","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-05-20T14:04:44.364824Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.17189"},"observation_digest":"sha256:3bf760a7c115e7cebe27606018093320c39e0e629e4f984f1ffce514439a2d7a","observation_id":"3140ed63-7dfd-4d76-8811-338169d8e264","resolution":{"observed_at":"2026-05-20T14:08:21.015617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.19392","last_updated":"2026-05-19T05:38:47Z","snapshot_observed_at":"2026-08-02T05:39:33.489285Z","submitted_at":"2026-05-19T05:38:47Z","title":"Understanding Dynamics of Adam in Zero-Sum Games: An ODE Approach","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T07:50:52.050949Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.19392"},"observation_digest":"sha256:6893f8583451fcf79ccae9478b0cd2b9096b5dbf7fdb587da5f60f99878b11c0","observation_id":"7661efd5-31c8-4a64-b9e1-e4e5fc134ed9","resolution":{"observed_at":"2026-05-20T07:53:09.858549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:4e05d8bdc24c2c5438a19608c72925fccaa2ecaacbf499e30fb08a01cb629cc7","observation_id":"1622cf25-36bc-4b78-ac98-ee0b0c320d51","resolution":{"observed_at":"2026-06-30T13:44:40.658304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.29919","last_updated":"2026-05-28T13:31:49Z","snapshot_observed_at":"2026-07-06T23:39:15.620929Z","submitted_at":"2026-05-28T13:31:49Z","title":"On the Geometry of Games and their Solvers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T07:48:32.317293Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.29919"},"observation_digest":"sha256:a20835c9047604ceb964769f3b8f37e7217797c8defda19c3d34575ff4689c99","observation_id":"5dc61c96-9e3f-475b-a16a-fca216f9f119","resolution":{"observed_at":"2026-06-29T07:53:13.525835Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2606.12149","last_updated":"2026-06-10T14:39:46Z","snapshot_observed_at":"2026-08-08T12:52:39.423749Z","submitted_at":"2026-06-10T14:39:46Z","title":"Do Not Discretize, Optimize: Almost Greedy Fictitious Play","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T07:50:44.299416Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2606.12149"},"observation_digest":"sha256:b0844c8f4a2e3f8117be4a760378085cc14ec52c6f48e8e0fb23b7a8925f0ac9","observation_id":"7ffc8502-34fb-41ae-a8eb-af540dc75423","resolution":{"observed_at":"2026-07-03T13:38:18.551458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2606.22502","last_updated":"2026-06-21T13:50:43Z","snapshot_observed_at":"2026-08-08T16:02:22.508428Z","submitted_at":"2026-06-21T13:50:43Z","title":"WebCQ: Cooperative Multi-Agent Deep Reinforcement Learning for Scalable Web GUI Testing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-26T09:54:19.822312Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2606.22502"},"observation_digest":"sha256:c01675efdfbd6f662bdce8ddf595bb9a93f2b326721dc8025149645f5b9b2884","observation_id":"50df0a72-b1bc-46c6-8966-e6f80626b861","resolution":{"observed_at":"2026-07-04T09:29:44.154908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-02T08:18:47.694004Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.21625","last_updated":"2026-07-07T16:28:38Z","snapshot_observed_at":"2026-08-07T06:36:20.299810Z","submitted_at":"2026-07-07T16:28:38Z","title":"Trajectory-Aware Retrieval Agents for Temporal Decision- Making","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-02T08:18:47.694004Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2607.21625"},"observation_digest":"sha256:d3ceed6995e7857cac3d2b3a464d587a2fc018b5e99bd4d3be8ed160e2c66ffc","observation_id":"03e07c32-802b-4575-ab27-4553dd73f86c","resolution":{"observed_at":"2026-08-02T08:18:47.694004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2011.00583/citation-record","integrity":"/paper/2011.00583/integrity","json":"/paper/2011.00583/citation-record.json","paper":"/paper/2011.00583"},"outbound":[],"paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","latest_version":5,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2011.00583."}