{"as_of":"2026-08-09T06:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1c3af3f81f10f80eeaaaf40a1eedcf11f8708842330882bfc20263f16e3d544","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:02:24.707037Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.20039/citation-record","integrity":"/paper/2506.20039/integrity","json":"/paper/2506.20039/citation-record.json","paper":"/paper/2506.20039"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.047041Z","title":"Stable matching with uncertain linear preferences","venue":null,"work_id":"ce3bcc0b-b27a-4774-a682-5130d29ee7c0","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.594430Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bfd8d1fe805a00782092a8f37c45af166f36428f539d63c387553a47aa32f025","observation_id":"7a5639bf-cd14-43b5-a012-a0a69ed01672","resolution":{"observed_at":"2026-08-06T23:02:25.050215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.037769Z","title":"College admissions and the stability of marriage","venue":null,"work_id":"ea99d34d-3700-4e55-bba4-369c89b8580c","year":1962},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.598695Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:4d2b0eec8c6ebb5937f87ecb5bd244506d8f856e9a2c4163197ac7bbca287103","observation_id":"46769786-b675-40a3-a040-f7aa58ebd7ad","resolution":{"observed_at":"2026-08-06T23:02:25.041145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.029037Z","title":"Hypernetworks","venue":null,"work_id":"996de28a-4a5c-412c-878c-e7690744959a","year":2016},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.602195Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:9c34779938c3009b407969db627dc33cac124185a73fee206636679d2d392d4a","observation_id":"b3eac34b-3100-42c6-bac9-33fdde0e2e1e","resolution":{"observed_at":"2026-08-06T23:02:25.032248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04376","last_updated":"2024-10-14T23:37:37Z","snapshot_observed_at":"2026-08-06T05:46:08.114765Z","submitted_at":"2024-10-06T06:47:53Z","title":"Putting Gale & Shapley to Work: Guaranteeing Stability Through Learning","version":2},"cited_work":{"arxiv_id":"2410.04376","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04376","snapshot_observed_at":"2026-08-06T23:02:24.812907Z","title":"Putting Gale & Shapley to Work: Guaranteeing Stability Through Learning","venue":"cs.GT","work_id":"6e12306c-7b1b-4abd-8fc0-d480c7096081","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.606383Z"},"links":{"cited_paper":"/paper/2410.04376","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:0e78fd9ab2b34541ba47627c42765bc34ce44bd953306f9d4d3606a7429ce2d9","observation_id":"b12e2aae-af6c-441f-9dfa-84008a9a6a11","resolution":{"observed_at":"2026-08-06T23:02:24.816273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04222","last_updated":"2021-06-11T18:53:47Z","snapshot_observed_at":"2026-08-07T20:55:19.729375Z","submitted_at":"2020-06-07T18:28:41Z","title":"Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2006.04222","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.04222","snapshot_observed_at":"2026-08-06T23:02:24.801049Z","title":"Randomized Entity-wise Factorization for Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"94fd776f-1389-4981-af85-15fb663060f0","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.610463Z"},"links":{"cited_paper":"/paper/2006.04222","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:b2d5be852c8b99833f380bbd5944f1496b892a1e412e851abbc13ffc6bc9b5ca","observation_id":"e94a828c-58e2-4c64-8e4a-e45361a16340","resolution":{"observed_at":"2026-08-06T23:02:24.804543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.019101Z","title":"Randomized entity-wise factorization for multi-agent reinforcement learning","venue":null,"work_id":"7ac00950-4f17-49a1-a922-2917c6c7fadf","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.614253Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:9ae557bfb9713cebd09aab0519b47a5f8b3e06f84375373ecd9f8cb36613dbb2","observation_id":"dab9c7a8-6212-41bd-8a69-735047f87efe","resolution":{"observed_at":"2026-08-06T23:02:25.022626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:25.008180Z","title":"Supplementary material: Randomized entity-wise factorization for multi-agent reinforcement learning","venue":null,"work_id":"3532d31f-a37d-48d1-93db-433249eb2e48","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.618001Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:1a90a6dcc41643c01a545db1942d2e92319abd3d030ba0762f331228c23be265","observation_id":"3435bb02-3a28-4653-920e-dc5c22e034e9","resolution":{"observed_at":"2026-08-06T23:02:25.011662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.997627Z","title":"Improved bandits in many-to-one matching markets with incentive compatibility","venue":null,"work_id":"d861829e-4b1d-423f-874f-d03dbe23c841","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.621332Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:4e1223c192cea868c5b0a8c1953e281dc28aefe3bed5e95f1b5206dd959d3c63","observation_id":"d47118d0-70bb-4634-9c74-dd1881eff4e8","resolution":{"observed_at":"2026-08-06T23:02:25.001442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.987444Z","title":"a fer, Andrew Wing Keung To, Kuan-Ho Lao, Murat Cubuktepe, Matthew Haley, Peter B \\","venue":null,"work_id":"ef157c12-20d3-41a8-bc15-5800a7ee9f5a","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.625364Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:90e6f4cf8c235371e2a1e6877c85d0ecb57d6acb4d461c8e5f6477ba3813c0c9","observation_id":"48877d1c-c5e1-49c7-a250-fe9c15168b0b","resolution":{"observed_at":"2026-08-06T23:02:24.991008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.978438Z","title":"Traffic control via connected and automated vehicles (cavs): An open-road field experiment with 100 cavs","venue":null,"work_id":"22302a46-cd2b-41a8-9fca-29007766c680","year":2025},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.629894Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:0318c6edab2f97a09017c39d3c08dbe3419e6e58abad0e67455605b1586f0733","observation_id":"11642d83-dec9-4ef0-b41c-a368e80bbd12","resolution":{"observed_at":"2026-08-06T23:02:24.981794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.967812Z","title":"Self-improving reactive agents based on reinforcement learning, planning and teaching","venue":null,"work_id":"7142aa8a-3f34-4056-8756-1739de263eef","year":1992},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.633163Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:9b0a08b6062917ee2d8b0287aaf449500110b07d6404ab6543a12aa8dc902d6e","observation_id":"f2658eeb-cf3b-4a2e-b0fd-10e43b7393c3","resolution":{"observed_at":"2026-08-06T23:02:24.972196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.958164Z","title":"Coach-player multi-agent reinforcement learning for dynamic team composition","venue":null,"work_id":"4d0f4a28-0b27-4edc-8060-2d12f9795588","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.636343Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:f7cfa56c47c8d7be146a1c82bee91fe933a6d107063497c2f6375266bc5b8ec2","observation_id":"074fbe33-7275-424d-b5c2-707fa11fb79c","resolution":{"observed_at":"2026-08-06T23:02:24.962122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.949150Z","title":"Competing bandits in matching markets","venue":null,"work_id":"496625f5-2bbf-49c8-8397-d58caf9a7f07","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.640108Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:4c6fb7f68d37a10844224d67ceee348ccca43aa42c602f826b438e0471b99100","observation_id":"f04278ee-2dca-4be7-8668-28abe5cb1af1","resolution":{"observed_at":"2026-08-06T23:02:24.952425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.643277Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.643277Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:da98027276d70dd65ad6034545abebaf0eb4e5e5725b0736406360dfea6e8fc7","observation_id":"98c76698-e626-437e-ab70-29ce687b52ae","resolution":{"observed_at":"2026-08-06T23:02:24.643277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.646615Z","title":"A concise introduction to decentralized POMDPs, volume 1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.646615Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:32fc8f5c3719a388366aaadf16e7993420cc3ecc608d016077cdde2e3b5e59f4","observation_id":"ec4aa29f-00a0-4ba2-91cc-cd15e4de6e4a","resolution":{"observed_at":"2026-08-06T23:02:24.646615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.927062Z","title":"Vast: Value function factorization with variable agent sub-teams","venue":null,"work_id":"55e7ecaa-9411-465c-a960-a160000a4f54","year":2021},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.650349Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bcd600c0f01a3027f48ac667135a7da5fcaa4fbed4f54f9263a29d76f2e98dd3","observation_id":"faf24d3a-6bef-4210-af83-591500930fd0","resolution":{"observed_at":"2026-08-06T23:02:24.930833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.916072Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"2f646c52-2832-4ad1-9ac6-a1f73d2b0775","year":2018},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.653564Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bd14ac27ab02903e699197f5c6f25d755fbc7075d2625b54a5a09124f3beeda5","observation_id":"b0c198d2-9533-4526-acaf-86a06819ec17","resolution":{"observed_at":"2026-08-06T23:02:24.919816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.656644Z","title":"The evolution of the labor market for medical interns and residents: a case study in game theory","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.656644Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:08bd58146ed2657154fef51492e9e92ec204fd5fe7b5883903bbf8f272fa1c1e","observation_id":"b03041e7-9959-45ee-8da9-140caa03d69b","resolution":{"observed_at":"2026-08-06T23:02:24.656644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.659867Z","title":"The redesign of the matching market for american physicians: Some engineering aspects of economic design","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.659867Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:66ef01794d9b2fe0134ce7184ee351b2dc6a3e3cd61318235d654e4364418818","observation_id":"06b10604-25c5-4091-bfbd-c09cfbb03418","resolution":{"observed_at":"2026-08-06T23:02:24.659867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-06T23:02:24.663940Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.663940Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:33d49515c9e392431f2ea3090445c64baa09a8bccf4879bf05e4b7cd35e984a6","observation_id":"bc81f89e-a19b-4baf-ac9f-ab4709027df4","resolution":{"observed_at":"2026-08-06T23:02:24.663940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.896037Z","title":"Multi-agent common knowledge reinforcement learning","venue":null,"work_id":"6ea5b490-af0d-4ab5-80ff-18d7002685d3","year":2019},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.667629Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:a1b95678518d44265094dbe669f6db43ab33df3f3b17baa68979ad33b232c2d4","observation_id":"ada18395-8398-4d1a-a694-79c060c82b58","resolution":{"observed_at":"2026-08-06T23:02:24.899257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.887032Z","title":"Self-organized group for cooperative multi-agent reinforcement learning","venue":null,"work_id":"9612c55f-004b-41a8-90dd-29d566d8db65","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.671392Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:3465666f2f59ddca1bc6df4e7a0a06cd06a6a0c24ca66f61253a755e0e4e4fd3","observation_id":"f4faa8b9-647b-4e8e-89f9-ba215c9f7986","resolution":{"observed_at":"2026-08-06T23:02:24.890617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.876306Z","title":"Complementary attention for multi-agent reinforcement learning","venue":null,"work_id":"77887c73-6712-4cec-a805-dad21980b987","year":2023},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.675025Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:bcbd8555b1068e7c11b726e3744873abc049f4d0114c66eaf5998d77f7153f5b","observation_id":"ed8dc84d-6866-4c25-9f4d-c70d3531a74c","resolution":{"observed_at":"2026-08-06T23:02:24.880095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-06T23:02:24.677906Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.677906Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:6a1e82544eec7f8f2c71168b1930d5ae7bd191d3d5674d8cb4a245c92e6327ab","observation_id":"ca2d4e57-492d-4b92-bb8b-f21c5dd1636b","resolution":{"observed_at":"2026-08-06T23:02:24.677906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01523","last_updated":"2020-10-04T09:20:59Z","snapshot_observed_at":"2026-07-06T10:01:17.424565Z","submitted_at":"2020-10-04T09:20:59Z","title":"RODE: Learning Roles to Decompose Multi-Agent Tasks","version":1},"cited_work":{"arxiv_id":"2010.01523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.01523","snapshot_observed_at":"2026-08-06T23:02:24.769361Z","title":"RODE: Learning Roles to Decompose Multi-Agent Tasks","venue":"cs.LG","work_id":"11bf5ead-4409-4dba-a1c7-4381ac45b91f","year":2020},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.681242Z"},"links":{"cited_paper":"/paper/2010.01523","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:3116e022f956733b4c142822ab3d7bcec63eb03f92f484871579e84856bb3409","observation_id":"c80fa642-2190-4b68-9251-4bc3e882a074","resolution":{"observed_at":"2026-08-06T23:02:24.772871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.865280Z","title":"Bandit learning in many-to-one matching markets","venue":null,"work_id":"9c053420-bce0-4540-bfa4-9bc1233b9e9b","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.684315Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:59d44e6eb85ab5ff7362080fac9c0ae246c31e41e0778097c59aefd5e5d3a0f3","observation_id":"9060c47b-6fa1-4cdf-9415-78ce84c183be","resolution":{"observed_at":"2026-08-06T23:02:24.869213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.855844Z","title":"Mutual-information regularized multi-agent policy iteration","venue":null,"work_id":"eaa94b52-e389-4413-98b1-1f2b9d8bcbc5","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.687037Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:e50ec2daf066d1082e9e27dcb126d91647939e3ecc19cbb9b60ea837f7cfa34b","observation_id":"97288320-c884-49c6-bae7-fbb21fb06501","resolution":{"observed_at":"2026-08-06T23:02:24.859040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-03T16:01:59.392774Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-06T23:02:24.690287Z","title":"Differential transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.690287Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:8af051a3e5fcbd4daae759b52c8f9cdbc75153d9ad2905270ec148c15df24a60","observation_id":"c503f879-3746-428b-b69b-6e01fede1f7c","resolution":{"observed_at":"2026-08-06T23:02:24.690287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.846126Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":"f2b8de0b-97f2-40ef-a3b3-a58e7b6f2177","year":2022},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.693264Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:17ce75c6a2b82f62103c493b8640fd40688e34be8157819109bc689b93bcd5b9","observation_id":"df51810c-7d7a-4e63-86a5-5ac8f72de928","resolution":{"observed_at":"2026-08-06T23:02:24.849716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.836828Z","title":"Automatic grouping for efficient cooperative multi-agent reinforcement learning","venue":null,"work_id":"17bb0315-674e-4d00-875f-7b1d9c26c10a","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.696185Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:5a65c85629052a33f696d85c2981cdc9e5b93bde1a2ab7ce812ea489d99d17ee","observation_id":"c0cdff10-c6fa-4fd4-b3c1-999bbac6c4e7","resolution":{"observed_at":"2026-08-06T23:02:24.840129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.08531","last_updated":"2020-10-16T17:42:11Z","snapshot_observed_at":"2026-07-06T10:05:13.535411Z","submitted_at":"2020-10-16T17:42:11Z","title":"Multi-Agent Collaboration via Reward Attribution Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.08531","snapshot_observed_at":"2026-08-06T23:02:24.699200Z","title":"Multi-agent collaboration via reward attribution decomposition","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.699200Z"},"links":{"cited_paper":"/paper/2010.08531","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:cf7da9d96b7e7e581e7e8015e122ba6117d0f3280497c49b775b7bb94e41e377","observation_id":"7831cae8-b698-456b-b2b7-ef239124daef","resolution":{"observed_at":"2026-08-06T23:02:24.699200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.827877Z","title":"Decentralized two-sided bandit learning in matching market","venue":null,"work_id":"7652d27f-baf3-43b4-a948-1a102ad838ef","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.701863Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:f4ae2a8c37a746bbed9bfbda3afc58a44f3aa2f433efbc5eca96e301db54a9d9","observation_id":"74d00d99-fcb3-4167-8165-a11aea147ea3","resolution":{"observed_at":"2026-08-06T23:02:24.830828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08021","last_updated":"2024-07-10T19:59:59Z","snapshot_observed_at":"2026-08-07T20:49:48.965722Z","submitted_at":"2024-07-10T19:59:59Z","title":"Field Deployment of Multi-Agent Reinforcement Learning Based Variable Speed Limit Controllers","version":1},"cited_work":{"arxiv_id":"2407.08021","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08021","snapshot_observed_at":"2026-08-06T23:02:24.735774Z","title":"Field Deployment of Multi-Agent Reinforcement Learning Based Variable Speed Limit Controllers","venue":"cs.MA","work_id":"6058e7cd-65e0-48b0-adca-e32f8863d81b","year":2024},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.704454Z"},"links":{"cited_paper":"/paper/2407.08021","citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:3b65d2c214a87684541e6b624cca976625304f5c9b70e8b962ff639ffdba4ea6","observation_id":"67482f99-fa48-4f50-be2f-7b43f3202e1e","resolution":{"observed_at":"2026-08-06T23:02:24.741328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:02:24.707037Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:02:24.707037Z"},"links":{"citing_paper":"/paper/2506.20039"},"observation_digest":"sha256:431dc6deb9efe13a0b99f94d64c8f10551753c09c48d5e2284e1f34ad7dd1099","observation_id":"1156f9e6-8de7-4150-8229-83f3eadb02b5","resolution":{"observed_at":"2026-08-06T23:02:24.707037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.20039","last_updated":"2025-06-24T22:40:05Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-08T13:43:28.137219Z","submitted_at":"2025-06-24T22:40:05Z","title":"Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2506.20039."}