{"as_of":"2026-08-17T19:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b463d92fe7ba4371eea11da66af86cb01a797f0de71b8635860fcc07a7cb17ec","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T21:47:09.404512Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01745/citation-record","integrity":"/paper/2608.01745/integrity","json":"/paper/2608.01745/citation-record.json","paper":"/paper/2608.01745"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:13.251548Z","title":"A survey of energy-efficient techniques for 5g networks and challenges ahead,","venue":null,"work_id":"0560363f-787d-4615-840b-8bdddb297459","year":2016},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.005794Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:afb99fe71e09e64d604c1b615dfa6995d42a9b0d4d342425af92ee0af4bca65f","observation_id":"3fe3a7b1-8a07-4cfa-8e4f-7a161a89c6c6","resolution":{"observed_at":"2026-08-04T21:47:13.326466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:13.054595Z","title":"Fundamental trade-offs on green wireless networks,","venue":null,"work_id":"2a70978d-a2c1-407e-8dc8-c16d4fb30a88","year":2011},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.147230Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:9f7992cf0075b29beece7ccc8df5f114637b28962258f56b6556cc9d5304019c","observation_id":"3b92f91b-f0cb-48fb-b18e-1dbf68f5d19d","resolution":{"observed_at":"2026-08-04T21:47:13.131632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:12.846235Z","title":"User association for load balancing in heterogeneous cellular networks,","venue":null,"work_id":"3135e261-b5ad-45be-8a3a-e885f4f0e4a9","year":2013},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.211354Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:bb81c6c1ca964ae552e1b29c8dfedfbbb0dfdd08ece2b7257b5f44748bbcf6f1","observation_id":"fbef9f3b-8504-4e1a-873c-2099d2e0eff3","resolution":{"observed_at":"2026-08-04T21:47:12.921585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:12.557871Z","title":"Multi-agent deep reinforcement learning for dynamic power allocation in wireless networks,","venue":null,"work_id":"63604f92-c1e4-4a3a-bfb1-b1824d0d9f74","year":2019},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.274222Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:cd0362ec867eaa45fbc438a5276d84d75af15c21c4286e7eb73530384561eb0d","observation_id":"86e3f3b4-9c41-45c2-8665-2c3ff82144d5","resolution":{"observed_at":"2026-08-04T21:47:12.687179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:12.348549Z","title":"Multi-agent reinforcement learning for multi- cell spectrum and power allocation,","venue":null,"work_id":"9d6ca154-d193-4a6b-9fd7-a5d2dd46dc51","year":2025},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.370858Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:d3cd47cab805d4d890076fdc59704075a4a8d84c829ec41f5020c847548ee282","observation_id":"f67cd864-3d23-4455-a972-1851cc2057ff","resolution":{"observed_at":"2026-08-04T21:47:12.424374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:12.167279Z","title":"Multi-agent reinforcement learning based resource management in MEC- and UA V-assisted vehicular networks,","venue":null,"work_id":"147a5987-6c81-47be-87ea-1f3f25e2594d","year":2021},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.411168Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:2410495097fb5a8c386e774b38de6e4642826ba8023b795543ca7091e8d71857","observation_id":"0e807296-fdfe-4370-a668-00bde082c2e7","resolution":{"observed_at":"2026-08-04T21:47:12.219954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:11.958005Z","title":"Multi- agent reinforcement learning for wireless user scheduling: Performance, scalablility, and generalization,","venue":null,"work_id":"d4d12d37-7351-4cc3-9e17-87f146e8e4a0","year":2022},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.510593Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:cef1b434d3fadf0b4ec45e02c0c62ecd1a44e00d9148ce35c8927a6a90ad2805","observation_id":"db996d96-7b49-4ad1-892c-061c52e07db9","resolution":{"observed_at":"2026-08-04T21:47:12.012042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:11.717729Z","title":"Multi- agent reinforcement learning-based distributed channel access for next generation wireless networks,","venue":null,"work_id":"b958ecd2-3b99-45f9-9b2c-bf39bde20f65","year":2022},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.620402Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:6c76f1bd32aa6ae9d0cc8ba2bf368d4f48d0bd811332ad1ae2223a947c46c250","observation_id":"1d8e1792-88c1-4f32-a88e-3677f3b5d34c","resolution":{"observed_at":"2026-08-04T21:47:11.814217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:11.536020Z","title":"Qippo/ca: A quantized communication-efficient marl framework for fully distributed channel access in next-generation wireless networks,","venue":null,"work_id":"4daf434b-34ce-4103-82c8-10be0eae1dde","year":2026},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.739169Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:a63655724edc341a71bb9c57e1c9a0dddd52379a43144ae96a20be5ab6c7eb4d","observation_id":"f4d4854a-a78b-4e9b-a4c4-755d2ccdb20c","resolution":{"observed_at":"2026-08-04T21:47:11.628411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:11.248530Z","title":"Multi-agent reinforcement learning for adaptive user association in dynamic mmwave networks,","venue":null,"work_id":"db902964-a98e-411c-9006-d827148edfdb","year":2020},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.876832Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:261427fead2bc6834291f713015c788f006d05ffe02e8c7fbf9440af7aefe3d0","observation_id":"33b8fc9c-ff07-4125-85dd-270e18f30eca","resolution":{"observed_at":"2026-08-04T21:47:11.342066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:11.011327Z","title":"Re- source Management in Wireless Networks via Multi-Agent Deep Rein- forcement Learning,","venue":null,"work_id":"a035d354-d9c8-412c-9970-3faa33610963","year":2021},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:07.960745Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:6f0ebf34bbed81c8fbeb55970f8ef4d406235afb3da4a42008300617a2e57221","observation_id":"1c160cfb-09fd-4be6-9cfd-09f04d7100f0","resolution":{"observed_at":"2026-08-04T21:47:11.112479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:10.745816Z","title":"Joint optimization of handover control and power allocation based on multi-agent deep reinforcement learning,","venue":null,"work_id":"f9bb69c2-9d7c-45cc-932b-92ae1eb85519","year":2020},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.072849Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:1a11ea2adf3d1ae33c5da458313953c0ab1de0c3b73c5be7897d603efbaf997b","observation_id":"1508dad8-d138-4114-8052-86506efc9a4d","resolution":{"observed_at":"2026-08-04T21:47:10.903091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:10.564730Z","title":"Rate control for communication networks: shadow prices, proportional fairness and stability,","venue":null,"work_id":"05c13b25-2273-497b-b88d-428ad7ec1229","year":1998},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.172944Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:0e3c349a553f436aeab74db80e3c9867e5fb07659e65cabbf25fa121c5df2429","observation_id":"068e4ea6-3891-4c60-a4e8-73165853b116","resolution":{"observed_at":"2026-08-04T21:47:10.637925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:10.391593Z","title":"Convergence of proportional-fair sharing algorithms under general conditions,","venue":null,"work_id":"e9cd582c-bf8d-4020-95b7-d24d107446c1","year":2004},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.262412Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:f6e968e8002ebcbf22b05771904eac4114cb6f6559471e2e361abf3be0de44c0","observation_id":"d879d78c-6908-4761-96f0-60548b7f7c0f","resolution":{"observed_at":"2026-08-04T21:47:10.465522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:10.180489Z","title":"An offline multi-agent reinforcement learning framework for radio resource management,","venue":null,"work_id":"689838c2-f9cf-4323-b88b-a5b46af8574c","year":2026},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.344500Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:beb5c1cfd95c142fab5c848466a1fe9e7d2f3d356d425135b03a89da8bca88c2","observation_id":"b2ca70a4-16b0-439c-a555-c81eae852a72","resolution":{"observed_at":"2026-08-04T21:47:10.277725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:08.385241Z","title":"Constrained policy optimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.385241Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:934f727a88dda55e6d0d3d27a28944a78f3b4eb87c4fc880ffeccdd0bf55013c","observation_id":"ec3d0851-e47c-4ef2-9688-d4d871f75754","resolution":{"observed_at":"2026-08-04T21:47:08.385241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02793","last_updated":"2022-02-10T07:08:47Z","snapshot_observed_at":"2026-08-16T17:51:26.635412Z","submitted_at":"2021-10-06T14:17:09Z","title":"Multi-Agent Constrained Policy Optimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02793","snapshot_observed_at":"2026-08-04T21:47:08.536662Z","title":"Multi-agent constrained policy optimisation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.536662Z"},"links":{"cited_paper":"/paper/2110.02793","citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:e96985561d27375aefa6053bd401d3a2d09d2fd35e9a6a868685399af4103f28","observation_id":"1e75df9c-492d-48f6-ab4f-12cc52d18ad7","resolution":{"observed_at":"2026-08-04T21:47:08.536662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:08.671006Z","title":"Neely,Stochastic network optimization with application to commu- nication and queueing systems","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.671006Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:74cbe8d1f8fc80a6b8c1ee2bb97f0a87075fc7f4dc847a430073f100e378444c","observation_id":"20b3ffc5-1cc6-4990-ba33-6a8e0673a926","resolution":{"observed_at":"2026-08-04T21:47:08.671006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:10.055419Z","title":"Lymarl: A lyapunov- guided multi-agent reinforcement learning framework for energy-aware radio resource management,","venue":null,"work_id":"f5994b16-024f-4312-b5b8-4eac8560d6cd","year":2026},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:08.846673Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:fc4c23ea88d522c3d1ac57abe700e639b45619786e4bbc180dc0a0b86082e786","observation_id":"84b799b2-651e-4320-8643-8a1ab7ee19d7","resolution":{"observed_at":"2026-08-04T21:47:10.106359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11251","last_updated":"2022-04-04T06:39:20Z","snapshot_observed_at":"2026-08-16T17:54:37.536674Z","submitted_at":"2021-09-23T09:44:35Z","title":"Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11251","snapshot_observed_at":"2026-08-04T21:47:09.010614Z","title":"Trust region policy optimisation in multi-agent reinforcement learn- ing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:09.010614Z"},"links":{"cited_paper":"/paper/2109.11251","citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:9dc232ce6881637e037c002bbff03a2a0944a1f2cfb0c26fceb0080bd1b3865a","observation_id":"8d46f04a-1a2d-4c1b-87ba-8bdd023b8cd3","resolution":{"observed_at":"2026-08-04T21:47:09.010614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:09.890406Z","title":"Toward dynamic energy-efficient operation of cellular network infrastructure,","venue":null,"work_id":"b63dc6ac-79ad-426c-8d79-e1afcea98b26","year":2011},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:09.117346Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:a8287c361de4146beeabc3d520ecdb7deb7e036a953769a8fa355f8b1455d128","observation_id":"9fb2613d-e8b1-4c95-bf48-e8a4570101cc","resolution":{"observed_at":"2026-08-04T21:47:09.966761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:09.733128Z","title":"Traffic-aware base station sleeping control and power matching for energy-delay tradeoffs in green cellular networks,","venue":null,"work_id":"24904a2a-e372-416f-919d-6a1702daeffb","year":2013},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:09.248198Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:d70806f8bbf8301f17100c1295dcc3b94dd6be6405d886a08fbdd683eb6e2483","observation_id":"714f8f2e-300b-4dfe-8505-d00b9f5f6066","resolution":{"observed_at":"2026-08-04T21:47:09.814166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T21:47:09.595557Z","title":"A quantitative measure of fairness and discrimination for resource allocation in shared systems,","venue":null,"work_id":"78540d6b-6e5c-4a9e-9bcf-662c9650acb1","year":1984},"citing_paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T21:47:09.404512Z"},"links":{"citing_paper":"/paper/2608.01745"},"observation_digest":"sha256:3c4544f9870402f6c7cdca63745d8af1a4cde2ec756c16cafc30c654a88b7f43","observation_id":"54d5250f-cdc6-45f9-b481-579d92067673","resolution":{"observed_at":"2026-08-04T21:47:09.662188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01745","last_updated":"2026-08-03T06:11:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T10:36:22.313020Z","submitted_at":"2026-08-03T06:11:38Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2608.01745."}