{"as_of":"2026-08-18T06:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1f8a25d7626bd9ce6c707d051b83089fbd204612df05747c0ad9f475061f8a9","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:16:13.519936Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10484/citation-record","integrity":"/paper/2505.10484/integrity","json":"/paper/2505.10484/citation-record.json","paper":"/paper/2505.10484"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.286622Z","title":"Deep Reinforcement Learning at the Edge of the Statistical Precipice","venue":null,"work_id":"19c200e0-b39f-451b-ac86-709b10918600","year":2021},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.304741Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:593d1316cc5f9ba4614eb9d0da09ff363eb975fc8cd2109541b9ee94da0c9424","observation_id":"795d48fe-f43b-4ae2-a6f6-8b4e04b24bb9","resolution":{"observed_at":"2026-08-15T21:16:14.292619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05789","last_updated":"2020-01-09T00:51:44Z","snapshot_observed_at":"2026-08-12T04:09:22.211968Z","submitted_at":"2019-10-13T17:17:52Z","title":"On the Utility of Learning about Humans for Human-AI Coordination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05789","snapshot_observed_at":"2026-08-15T21:16:13.310838Z","title":"Ho, Thomas L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.310838Z"},"links":{"cited_paper":"/paper/1910.05789","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:6e9d69f7ed224fb9ed052254b622b7566c61dd969ac3e8e17ca4c6a6560f3e87","observation_id":"9ed94a6c-c42a-44fc-898d-b98ee0219e9c","resolution":{"observed_at":"2026-08-15T21:16:13.310838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.316231Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.316231Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:8a0eb0b08ee52368aff29420f278e9996d4a904105666397ee68ce9f71991291","observation_id":"0cde20da-695e-4ed5-99cc-3ebcec5c571e","resolution":{"observed_at":"2026-08-15T21:16:13.316231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07489","last_updated":"2023-10-17T14:05:58Z","snapshot_observed_at":"2026-08-16T16:08:35.587158Z","submitted_at":"2022-12-14T20:15:19Z","title":"SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07489","snapshot_observed_at":"2026-08-15T21:16:13.321615Z","title":"Foerster, and Shimon Whiteson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.321615Z"},"links":{"cited_paper":"/paper/2212.07489","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7ee0034e593fcf4dfc63e0ad60329b75e8ab6ce1a0456f1fadc4002d17adb2f1","observation_id":"471b4d97-cece-4c7a-aad5-ae97236e3877","resolution":{"observed_at":"2026-08-15T21:16:13.321615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.326732Z","title":"Approximation capabilities of multilayer feedforward networks","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.326732Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3c1637cb96a9514d44c1b1342e4a7cc8f6f00d3be51102dc9181b2ec25dda4cc","observation_id":"8d4a3314-cdd3-4200-bf96-edc85ff04ff2","resolution":{"observed_at":"2026-08-15T21:16:13.326732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.331537Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.331537Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7001fbc4b6b5dacee158ce245f4794c505551477ff928cac085f755dab49d236","observation_id":"4ba6118e-b828-474c-9aaa-74110585d108","resolution":{"observed_at":"2026-08-15T21:16:13.331537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.259312Z","title":"On the Variance of the Adaptive Learning Rate and Beyond","venue":null,"work_id":"0b6a7924-230d-4ae0-bb68-4741e15906c3","year":2019},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.340955Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7993bbac0418819c61c0d9909f060677fafc83c0eb70b301fa99b8a44eee525c","observation_id":"74ef886b-23e9-4591-8023-4e4baf394119","resolution":{"observed_at":"2026-08-15T21:16:14.264736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.243083Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","venue":null,"work_id":"62385026-52ba-4763-b546-145835fffc6f","year":2017},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.345996Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:1bafa8f985fe34db1d53c7efce227b481b711d2ab43ed370a92f4f3323b064b0","observation_id":"319d947c-d892-4f0d-8097-87d60163ae15","resolution":{"observed_at":"2026-08-15T21:16:14.247973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15381","last_updated":"2024-09-09T22:49:17Z","snapshot_observed_at":"2026-08-16T13:23:23.370882Z","submitted_at":"2024-08-27T19:45:26Z","title":"On Stateful Value Factorization in Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2408.15381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.15381","snapshot_observed_at":"2026-08-15T21:16:13.599286Z","title":"On Stateful Value Factorization in Multi-Agent Reinforcement Learning","venue":"cs.AI","work_id":"7c45a384-b39f-46f6-ad2b-b2d139d6de18","year":2024},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.350758Z"},"links":{"cited_paper":"/paper/2408.15381","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:e5e142e6bc7a393cdd14379d4d0689e6012f76dbdd4822fcd7d6167785d7963f","observation_id":"64ddc08d-2015-464b-8e0e-202931483bbf","resolution":{"observed_at":"2026-08-15T21:16:13.606724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.227482Z","title":"Oliehoek and Christopher Amato","venue":null,"work_id":"a6452351-84a5-4b0c-a557-c2ce07eb30b4","year":2016},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.355620Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:20cc3c5d0b676a81f8e683fc976ea7eef30d806cfe2b9e3b30090a47b23249d8","observation_id":"05a8aa1e-467d-454e-8504-c99cc7131c45","resolution":{"observed_at":"2026-08-15T21:16:14.232581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.360340Z","title":"Approximation theory of the MLP model in neural networks","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.360340Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:36ad25c108798e2214be66b912236f7916775473a527f5025a3be69a89e3abff","observation_id":"6e529edc-9510-4c3a-b749-cb68c1b806e9","resolution":{"observed_at":"2026-08-15T21:16:13.360340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.212399Z","title":"Weighted QMIX: Expand- ing Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","venue":null,"work_id":"2f7d9d1e-06b9-4ea1-8037-101fa30ef0bb","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.365190Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:905a5832fa29807e6bc0ba306aa062138b0912246d4f7712941aa09e25b4434b","observation_id":"5e07e191-992d-4db0-9014-843c6f7656ba","resolution":{"observed_at":"2026-08-15T21:16:14.217379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.196862Z","title":"Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","venue":null,"work_id":"57c3c11c-1b17-4de5-a083-a3c41256a420","year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.370555Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:cb09abf58a4a11d7b9ce05d3973220e688e9cfc4af734f549c476770ea361899","observation_id":"35309acd-c774-43cb-919d-377e450f4dc1","resolution":{"observed_at":"2026-08-15T21:16:14.202319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.181465Z","title":"JaxMARL: Multi-Agent RL Environments and Algorithms in JAX","venue":null,"work_id":"532f398a-9d86-43d5-b633-c95f7811bc85","year":2024},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.375948Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:1d2055c6eb2322cf57d89fc10a0e74a8a10f6a188f5f32b1db05c36732300c80","observation_id":"9b98e59c-8da1-4d39-9cc6-fadfa1f37fed","resolution":{"observed_at":"2026-08-15T21:16:14.186418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.164986Z","title":"QTRAN: Learning to Factorize with Transformation for Cooperative Multi-Agent Reinforcement Learn- ing","venue":null,"work_id":"51879c1c-b0de-4767-b2fa-df437bcc0c39","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.381020Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:5dd4f5ce4b136b6764aa671fff4c5f79e50bf5525897471eb5991187f57cda7f","observation_id":"f1aad31b-a421-4f2d-93f6-74d0f144c0ec","resolution":{"observed_at":"2026-08-15T21:16:14.170331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-15T21:16:13.390697Z","title":"Leibo, Karl Tuyls, and Thore Graepel","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.390697Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:61f1e08b844f291a5e9e29127742d29a2505762519ae5ab0b15276f3d43c6f47","observation_id":"ce318488-ae01-437c-811c-a065ceb5edc3","resolution":{"observed_at":"2026-08-15T21:16:13.390697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.134333Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","venue":null,"work_id":"a82c694b-78a9-47cd-a8bc-ff6f781a4708","year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.395948Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:2f958c9d8cd167d59b64a4e2db4e71e29ab60e30f48f6cc658c284e09c08d3f8","observation_id":"9472af51-f23c-4267-b047-65ef27f79ca1","resolution":{"observed_at":"2026-08-15T21:16:14.139202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.119112Z","title":"Towards Understanding Cooperative Multi-Agent Q-Learning with Value Factorization","venue":null,"work_id":"060d357d-3440-4cf7-8fbb-0874eaf7a09e","year":2021},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.400641Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3785de44b0baa6a9a4c6e7f0d26c98b7a2d0474dadd5456fd9818e3e30cbfb8a","observation_id":"ba744468-a33a-4174-83c6-8a5c07a2b1b3","resolution":{"observed_at":"2026-08-15T21:16:14.123982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.102956Z","title":"strong” forms of UAT not formally applicable, and come to the primary conclusions that (i) only “weak","venue":null,"work_id":"e65e11d0-12de-4477-b0e6-260442cc3e95","year":1995},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.409749Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:a40f29bfd85bf3f2aace926f16e20b4c71846f7ad5cdb34921e001d813b7bf9f","observation_id":"bfea6062-67d3-407a-99d7-643e813deccd","resolution":{"observed_at":"2026-08-15T21:16:14.108539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.087480Z","title":null,"venue":null,"work_id":"8def6a27-e418-48f4-a1c7-e7d8b1225e7a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.414915Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3a39b484897496cb9112b102da014a191658b297ea7399a55726b9a0c6691a8d","observation_id":"31389fc3-f51f-4bf0-9bf3-6020237ee1f4","resolution":{"observed_at":"2026-08-15T21:16:14.092145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.071232Z","title":"Step 1 was already proven earlier","venue":null,"work_id":"84cb78f2-2c71-4278-bd21-44ed43ef46cb","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.419518Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:27d5abdeac87da2e0880a6fb875f2c5c49fd119b25d98b02e434a47f288cc4a8","observation_id":"af4f94c6-49c4-44b0-8edf-8230a7307bc0","resolution":{"observed_at":"2026-08-15T21:16:14.076081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.054837Z","title":null,"venue":null,"work_id":"373993d2-f0ce-4c40-8dff-9e76578a13a0","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.424966Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:1b30aaf6590bd5201e44d8ded19942cdbc3f573f2ae5108444918397d981e35a","observation_id":"0e13f432-f61b-4e4e-9e0e-caa4aa5d68eb","resolution":{"observed_at":"2026-08-15T21:16:14.060272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.039910Z","title":null,"venue":null,"work_id":"7466d67a-c4bc-448e-a419-ae53927e9ffa","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.429253Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:2f2078ec7bf80d11b265b5706fbc34e8671030edeee2f5870335621ebbab2022","observation_id":"c10e5c90-f1bf-4802-a59a-276073060f88","resolution":{"observed_at":"2026-08-15T21:16:14.044261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.025060Z","title":null,"venue":null,"work_id":"1c51887c-96f2-445c-8955-0b1eba1be44b","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.433903Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:8b5bbf30257aa46bb1a2c0dae82990c2c65378ada9c6529c5d061d5f6fdc69af","observation_id":"f8fc2925-4450-4cbc-993b-be9ae36b8e75","resolution":{"observed_at":"2026-08-15T21:16:14.030054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.009109Z","title":"X” over VDN. 0 2 M 4 M 6 M 8 M 10 M Timesteps 0% 25% 50% 75% 100%Pr(X > Q+FIX-sum) Model Q+FIX-sum Q+FIX-mono Q+FIX-lin QPLEX QMIX VDN (b) POI of model “X","venue":null,"work_id":"23494e67-878b-4f99-b2a2-d8bfa78364ad","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.438634Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:f2a65bcd275ec5896bda431089da88f3852f687757ee87d8bdc705664d5ba3c9","observation_id":"831562a0-8669-4a16-9625-1412b60b28ba","resolution":{"observed_at":"2026-08-15T21:16:14.014285Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.992789Z","title":"Guidelines: • The answer NA means that the abstract and introduction do not include the claims made in the paper","venue":null,"work_id":"ff97a6fa-8be0-4cff-bf6f-a80bc2204b15","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.444469Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:facd0de83d883fc485e4ab993536871c597f2e6997d7c5ce23ce47dca7fe0eab","observation_id":"5c2a4547-938f-47c6-a3a2-5636202f65e4","resolution":{"observed_at":"2026-08-15T21:16:13.997730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.976975Z","title":"Limitations","venue":null,"work_id":"897864cf-45c9-4eeb-a5a0-eabbb528da25","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.449151Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:907de9bdb58237ee2772f307718d5b63ffaab2e0e2a3e13688b5ac2661ada534","observation_id":"cab75a2a-20b6-46dc-a5cb-25c90069538d","resolution":{"observed_at":"2026-08-15T21:16:13.982079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.961146Z","title":"Proof sketches were omitted in the main document due to the proofs being strictly technical, and space limitations","venue":null,"work_id":"c08e57e6-9dcd-4d91-98f7-dbe4673deb6a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.454030Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:4e63fcc6326f36b0d3610b8d7cec13e40531b9e12078693050f6dfeea59e02c7","observation_id":"32f9a792-52cf-4b70-a054-3385f34237dd","resolution":{"observed_at":"2026-08-15T21:16:13.966332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.943397Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"459749a5-80cd-4ef2-95ac-f53099c07980","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.459189Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:baa0d3a10491bd2a2776d24da3814dbc0eb0d5b3da8d8d3f28e59e7acabf9d98","observation_id":"10c0417c-6b13-4509-bffa-4981ea3043b3","resolution":{"observed_at":"2026-08-15T21:16:13.948267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.927029Z","title":"Instructions for the Pymarl2 imple- mentation are provided in the readme","venue":null,"work_id":"f8e71841-4aa9-4b38-8c41-3f8bfafdb107","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.464605Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:12f2ffc314c1eec1b71fd44300ef6792c016ed74067065e00726973240154500","observation_id":"ea0a9f25-2608-4b3b-90b9-92c15692785a","resolution":{"observed_at":"2026-08-15T21:16:13.932200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.909559Z","title":"Any additional component (e.g., the architectures of Q+FIX) is both described in the appendix, provided as supplementary material, and will be linked in the camera ready)","venue":null,"work_id":"dbaac2f5-feba-47b3-b948-e5c06a6c4288","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.470157Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3f29b56a61700c2b15ad50bc89f805bb86ab217d946e0073e54652ae58ed7ede","observation_id":"881cb253-74a8-43f5-9f9e-dd80e232e2cb","resolution":{"observed_at":"2026-08-15T21:16:13.915624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.894289Z","title":"30 Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"ecb7adb6-1b66-4cb3-84cf-a438697813dd","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.474770Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:abf5e2ce3eb59762c47c27128fbc7efd2132421560cdb3fc4b6b543fbc95e070","observation_id":"7eb5c3bf-be52-4974-89c1-eaaccbd79df1","resolution":{"observed_at":"2026-08-15T21:16:13.899179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.878525Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"e4944eb7-6e4a-45bc-805f-9c65111a8b14","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.479499Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:630b24f0836d16d6d3bedeb741453d2a11bc8cd19f69e28f5c91f38cbf169817","observation_id":"cf311fb4-8669-4027-884d-73681e896931","resolution":{"observed_at":"2026-08-15T21:16:13.883365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.862672Z","title":"Guidelines: • The answer NA means that the authors have not reviewed the NeurIPS Code of Ethics","venue":null,"work_id":"a83f03e1-aa75-4046-8090-c916478da2a3","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.484547Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:655213be370714ab2652ca69b0c24417578cc13e12f58f7f93455cc2f2b7f357","observation_id":"510df453-739c-4fe6-af91-918d30c7d1d5","resolution":{"observed_at":"2026-08-15T21:16:13.867762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.845872Z","title":"Guidelines: • The answer NA means that there is no societal impact of the work performed","venue":null,"work_id":"f34b17fd-99d9-48ff-8971-a319203a6634","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.489787Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:2808f5f1f5ec895e591547298f839697c827d8046296e9a51b2672d5e0783dc7","observation_id":"c135fa70-c6e6-4648-a995-491b7c44efb6","resolution":{"observed_at":"2026-08-15T21:16:13.851568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.495269Z","title":"Guidelines: • The answer NA means that the paper poses no such risks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.495269Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:42f8a3592d59e35c803581208f5d4ae8a5bf5ab41e431d33a1652c3fb6cd89e7","observation_id":"afb78ee5-74f9-4211-8a34-f31104942437","resolution":{"observed_at":"2026-08-15T21:16:13.495269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.819855Z","title":"Our own implementations continue to use the same license","venue":null,"work_id":"636227ff-1f6a-43a8-a4d7-164a195b200a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.500140Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:0f5296a6d94dfeba2f65fea5b793b8c47a7e29ec5f6dacacdd50a8e2fd4129e8","observation_id":"a32521cc-6d37-4431-82a1-da5859a361b2","resolution":{"observed_at":"2026-08-15T21:16:13.824815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.803384Z","title":"These will be provided as forks from the corresponding repositories","venue":null,"work_id":"3ee0d003-fb04-4a7b-a08d-1a2b32412b89","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.504937Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:e2b64912fb60ceb3860469f57564d5f1e4e37958f685c1bd10ca77e8b4e4f136","observation_id":"7149d4e6-4076-494e-b95c-75d78a61afce","resolution":{"observed_at":"2026-08-15T21:16:13.808383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.509930Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.509930Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:5e7eb948a57ef13bdeb58aa30c6462ae5340e7cd6a63afd673b43ddab0bfafce","observation_id":"99216728-c6c2-4764-8904-6c60370bcf53","resolution":{"observed_at":"2026-08-15T21:16:13.509930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.777459Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"0163590d-a1ee-4759-85eb-ed836716c40a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.515014Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:fc8b69f5bee36f17cf96d5386cc0c424f4b07b670af1105bd1fc9c58c643084e","observation_id":"efbd9c8a-04c3-4ea0-be34-11e5f63e000c","resolution":{"observed_at":"2026-08-15T21:16:13.782856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.760698Z","title":"Answer: [NA] Justification: The core method development in this research does not involve LLMs as any important, original, or non-standard components","venue":null,"work_id":"7d565da3-9f4c-4f6a-8623-7ee58fad4fed","year":2025},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.519936Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:d1569726bec889105473a854c6e0864bc37bfb5623d1a05298d6b2d0eef5a50e","observation_id":"6ccd11fc-55da-43ed-9cc0-2cc13dff3f31","resolution":{"observed_at":"2026-08-15T21:16:13.765635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T21:16:13.336147Z","title":"arXiv:1412.6980 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.336147Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:fdde9cb80aea6a4ee2d723dc7f2bf3f56a0b1dfb79dc1a5c4e2916fc8e64664f","observation_id":"191ede31-c902-4d49-9df9-19dfc4e13d17","resolution":{"observed_at":"2026-08-15T21:16:13.336147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.149637Z","title":"URL https://proceedings.mlr.press/v97/son19a.html","venue":null,"work_id":"3bd39af2-84a8-4832-81c8-e5654911f583","year":2019},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":5896,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.386077Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:12e2c1db552c2f3afc1c46dc77668b413b7b0fa6bb86e5723bb6616ae74cd76e","observation_id":"7f2fed18-76d5-43ec-9a5f-7b3f90fc9e4a","resolution":{"observed_at":"2026-08-15T21:16:14.154631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2505.10484."}