{"as_of":"2026-08-18T15:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89b702f5ec2c2b688dfdd1649d6816a76bf8ea5bb53d93977416340934961158","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:02:18.838862Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.06554/citation-record","integrity":"/paper/2501.06554/integrity","json":"/paper/2501.06554/citation-record.json","paper":"/paper/2501.06554"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1609.05140","last_updated":"2016-12-03T02:47:51Z","snapshot_observed_at":"2026-08-14T21:59:38.551417Z","submitted_at":"2016-09-16T17:05:55Z","title":"The Option-Critic Architecture","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.05140","snapshot_observed_at":"2026-08-10T21:02:18.674067Z","title":"The option-critic architecture","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.674067Z"},"links":{"cited_paper":"/paper/1609.05140","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:205fb6ce1640d0d5a6d1268e0f261ba51de8dde533fefb21f3e5450411793dcd","observation_id":"eadc3631-0158-434b-89ca-ae7084e7a4f3","resolution":{"observed_at":"2026-08-10T21:02:18.674067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12825","last_updated":"2020-03-19T23:11:08Z","snapshot_observed_at":"2026-08-14T17:58:52.195808Z","submitted_at":"2019-11-28T18:38:19Z","title":"Option-Critic in Cooperative Multi-agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12825","snapshot_observed_at":"2026-08-10T21:02:18.679710Z","title":"Option-critic in cooperative multi-agent systems","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.679710Z"},"links":{"cited_paper":"/paper/1911.12825","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:90fdf4a4a6823d3eff10acd8d6ce96acea68cafbdc292c91e69583517620b862","observation_id":"0fea0433-c780-4c95-9865-f9908bac73d3","resolution":{"observed_at":"2026-08-10T21:02:18.679710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02628","last_updated":"2022-01-07T18:44:28Z","snapshot_observed_at":"2026-08-16T17:29:40.635004Z","submitted_at":"2022-01-07T18:44:28Z","title":"Attention Option-Critic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02628","snapshot_observed_at":"2026-08-10T21:02:18.684622Z","title":"Attention option-critic","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.684622Z"},"links":{"cited_paper":"/paper/2201.02628","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:f3754241203fa5c872a17c331cc426bb8b26f2d7ca48c946e8e88a85b4a0a807","observation_id":"f5ecb7a5-0afa-4c58-a1d6-afedcb1734fd","resolution":{"observed_at":"2026-08-10T21:02:18.684622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.296180Z","title":"Dynamic planning in open-ended dialogue using reinforcement learning, 2022","venue":null,"work_id":"1f2e7fb5-e4a9-4e57-bd53-762864c7ec76","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.694553Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:adf68070be4be404f83ae30565b6abd2b9631a1a1eb711701e60c99476a324d0","observation_id":"95d6cceb-71fc-4029-b7cc-d00353e345d1","resolution":{"observed_at":"2026-08-10T21:02:19.303210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.271396Z","title":"Handbook on agent-oriented design processes","venue":null,"work_id":"0ee21d84-8742-4e2c-bf51-024e3b8a6545","year":2014},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.701957Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:bf1163563047a610ddae6e11e84d1b952c1e4b069fbc93c34092159c392367f4","observation_id":"6c0a99da-a5ad-4ac9-a9e3-1e271965f52d","resolution":{"observed_at":"2026-08-10T21:02:19.277212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.252618Z","title":"Multi-agent deep reinforcement learning: a survey","venue":null,"work_id":"132e7e67-a5d8-4292-8945-c064f0047e33","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.707714Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:a7a048f394b3e2945a643c4dbc5e0887f11fa197fe6e451cec916777d52131e5","observation_id":"083f9d7f-3773-4241-bcaf-0371ef7eb66f","resolution":{"observed_at":"2026-08-10T21:02:19.258403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05599","last_updated":"2022-05-13T22:27:11Z","snapshot_observed_at":"2026-08-17T17:39:43.210150Z","submitted_at":"2022-05-11T16:16:07Z","title":"Two-sided matching with firms' complementary preferences","version":2},"cited_work":{"arxiv_id":"2205.05599","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.05599","snapshot_observed_at":"2026-08-10T21:02:18.954117Z","title":"Two-sided matching with firms' complementary preferences","venue":"econ.TH","work_id":"ce160ba4-e670-44a5-9282-f93e84f69c59","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.713199Z"},"links":{"cited_paper":"/paper/2205.05599","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:0fc5d09cbf03ad72a06cceca4422dd8edf2330cc8b64c283dc236190309923d9","observation_id":"c158bcc2-96ad-413d-a973-cabd98069dd6","resolution":{"observed_at":"2026-08-10T21:02:18.959877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.228420Z","title":"Emergence of division of labour in halictine bees: contributions of social interactions and behavioural variance","venue":null,"work_id":"479d997a-cf6b-4168-b084-84092c2250d7","year":2005},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.722528Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:031a9815c3cb31572dc97272cf47fe5bd6a864031f4126c28787ed91a156f01c","observation_id":"b583ae01-4be9-4f64-a809-2756a559dd15","resolution":{"observed_at":"2026-08-10T21:02:19.235230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.209502Z","title":"Multi-agent deep reinforcement learning with type-based hierarchical group communication","venue":null,"work_id":"84303e5d-86f1-4312-a860-6ddee6c0d9c6","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.729786Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:670db835f97a3c5a994af5381c3b32e568da9d1ef20556f96d364b92757ce382","observation_id":"83cdcd13-c859-4f58-88fb-bdaa6365972d","resolution":{"observed_at":"2026-08-10T21:02:19.215155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.184273Z","title":"Multi-agent reinforcement learning as a rehearsal for decentralized planning","venue":null,"work_id":"af623241-5209-4ee0-a2bb-2834832aaa43","year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.737992Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:9ab6ebe3ef0d672ee4044507867dc548b37ac4ca62f811592def20f49964f1e2","observation_id":"090d9cbc-c6f9-4f6b-a59b-da3d7fd0a000","resolution":{"observed_at":"2026-08-10T21:02:19.190680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s20247094","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.913467Z","title":"Reinforcement learning-based joint user pairing and power allocation in mimo-noma systems","venue":null,"work_id":"274b0ae5-fec5-4410-9ecd-1e7a99ca4fed","year":2020},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.744243Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:9d92d0f3bb32fa34d702fb235ccebcd96cae6ac096d94c4f1bd9fb78c6bcda3e","observation_id":"431133cc-3620-43dd-a3e7-2becf05f7e7b","resolution":{"observed_at":"2026-08-10T21:02:18.918637Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.163168Z","title":"Role-based modeling for designing agent behavior in self-organizing multi-agent systems","venue":null,"work_id":"1f64e819-10c7-48b5-a033-cb84b0f1a375","year":2018},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.748639Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:0eccc4413937781290038cc4b95d008a81dcc06f788aca82a6103a0912142304","observation_id":"e289dd3b-78f5-4d0e-9483-30ed71682821","resolution":{"observed_at":"2026-08-10T21:02:19.168675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.146729Z","title":"Jordan, and Zhuoran Yang","venue":null,"work_id":"fd4997e0-1d7d-41d0-ba4f-6457f5fe04d7","year":2022},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.754362Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:a9ced42f99ae26a27fbb7d30b93397ff50e8141cbe074989709b97f97a72c32e","observation_id":"b0aa34ba-ace1-4d61-bd3e-c2063dff96d8","resolution":{"observed_at":"2026-08-10T21:02:19.151523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.130329Z","title":"Optimal and approximate q-value functions for decentralized pomdps","venue":null,"work_id":"538fdef1-0a71-423a-83af-20affd72b332","year":2008},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.760712Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:20ddb89766c813815504096f2ed8828341806591ff8c81e9872b15e9b1f2db3b","observation_id":"c1121493-a712-4bd5-9e3b-a86a99abd94b","resolution":{"observed_at":"2026-08-10T21:02:19.135232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.768939Z","title":"Hierarchical reinforcement learning: A comprehensive survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.768939Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:642dfbf2d55c3652facdf57a6e5f73fda8e4ddc6138fac85b209047a3584250b","observation_id":"a4e77e8b-586f-4c33-a74f-83ea0aac2ac0","resolution":{"observed_at":"2026-08-10T21:02:18.768939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.776671Z","title":"Vast: Value function factorization with variable agent sub-teams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.776671Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:ab78a8df617500eed3d76a13c48e9d3ebc8a774e5182890fd5557ac4b76454ae","observation_id":"58fb5ca5-523b-4bcc-8d02-a0972aa9a9da","resolution":{"observed_at":"2026-08-10T21:02:18.776671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.095520Z","title":"Advances in neural information processing systems 17: proceedings of the 2004 conference, volume 17","venue":null,"work_id":"c53ea61e-31d4-40b2-b031-af0299f49ece","year":2004},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.784316Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:7d7dd4646dde6c28ae3ba9b8584a96cb991e7960827c0042f182a9fb4f60c532","observation_id":"ba9c940b-af4e-41bf-b55a-d52e52d2de95","resolution":{"observed_at":"2026-08-10T21:02:19.103251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.796890Z","title":"Sutton, Doina Precup, and Satinder Singh","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.796890Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:525d5b7126ed0b42022bc7f6fe38560f904a6830cc4c3c7f6e003e42954f868c","observation_id":"986987ca-1a48-4a50-810a-63112b531ac5","resolution":{"observed_at":"2026-08-10T21:02:18.796890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.078756Z","title":"Effectiveness of gamified team competition as mhealth intervention for medical interns: a cluster micro-randomized trial","venue":null,"work_id":"859dee95-9193-4b35-aad8-4f3af192abe8","year":2023},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.802360Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:05c76dc1304cbf2c1d25f17648e5080cb4c554e8e9ca3f1613fff2f3d9f51cc2","observation_id":"c42a5f96-d91a-4728-b5e7-398ca9a73480","resolution":{"observed_at":"2026-08-10T21:02:19.084218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.065949Z","title":"Beaulieu, and Y","venue":null,"work_id":"bf7ba663-e51c-4a7d-8f47-132b175019d6","year":2021},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.808135Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:58ea18c657245d1ccfbbd45d78205302c9b64975295d94a58574d52ea430b42c","observation_id":"25a0eddb-fe5e-48dd-b9dd-891f822cd454","resolution":{"observed_at":"2026-08-10T21:02:19.069932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.049538Z","title":"Adaptive dynamic bipartite graph matching: A reinforcement learning approach","venue":null,"work_id":"daf3d7ba-b4ac-4c62-bf8a-ac20c75db20c","year":2019},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.813132Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:c39388924e61cd868e09480cb7369494021131005595e42d3aae325bee17a2be","observation_id":"d7f37294-37b6-44e2-a88e-e1eb4c05c8e9","resolution":{"observed_at":"2026-08-10T21:02:19.055682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.031947Z","title":"Hierarchical dominance structure and social organization in african elephants, loxodonta africana","venue":null,"work_id":"194414f1-c932-4c95-a862-bb2bbb9b714d","year":2007},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.821021Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:18f4b209067677ee667a78a19f147e7c776643729f1e6dcee7ffe18cc8b52776","observation_id":"aa678bbc-d480-441f-a8c5-4eff6275f472","resolution":{"observed_at":"2026-08-10T21:02:19.036585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:19.017950Z","title":"Large-scale order dispatch in on-demand ride-hailing platforms: A learning and planning approach","venue":null,"work_id":"ffed70d0-d3a4-4cf2-a571-7a4f02b53347","year":2018},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.826218Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:82820fa702d17d3b39307977ac47c2ba51b4c738b499ed1c1501d4a698c17507","observation_id":"e7e48205-37c8-4852-b131-6c3c71240ba8","resolution":{"observed_at":"2026-08-10T21:02:19.022090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06114","last_updated":"2018-04-14T18:54:19Z","snapshot_observed_at":"2026-08-15T19:29:25.073045Z","submitted_at":"2017-03-10T21:02:53Z","title":"Deep Sets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06114","snapshot_observed_at":"2026-08-10T21:02:18.831276Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.831276Z"},"links":{"cited_paper":"/paper/1703.06114","citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:4a2d4eb44d61d23398e9747fede4c161406411ab35991197f59903872629ff2c","observation_id":"8e214a0b-6254-44c9-a47d-0ce9e1dca286","resolution":{"observed_at":"2026-08-10T21:02:18.831276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.eswa.2016.07.047","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:02:18.886570Z","title":"Reinforcement learning based local search for grouping problems","venue":null,"work_id":"cedbb85f-fcc9-44f0-90ad-b7cdca182061","year":2016},"citing_paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T21:02:18.838862Z"},"links":{"citing_paper":"/paper/2501.06554"},"observation_digest":"sha256:bb222c3bd1dbdf4a06c9e5201cf1074b958367dae677454e02ab28cef11d4aa4","observation_id":"f0d3cc4c-a014-4406-b5e2-c81ee647b00b","resolution":{"observed_at":"2026-08-10T21:02:18.895206Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.06554","last_updated":"2025-01-11T14:22:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:09:10.635468Z","submitted_at":"2025-01-11T14:22:10Z","title":"Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":15},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2501.06554."}