{"as_of":"2026-08-09T01:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4adeb24aebea34069e3b9fa27a9135b81d6837f78ce2a74a1fd68ac2575c722a","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:34:20.119341Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.06607/citation-record","integrity":"/paper/2603.06607/integrity","json":"/paper/2603.06607/citation-record.json","paper":"/paper/2603.06607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.093903Z","title":"Multi-agent drl for resource allocation in vehicular networks: A comparative study,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.093903Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:685dda3ea7a21febf40fecc14d85074c0f089cd1dad91d783e0aae3aa4f941be","observation_id":"9f1c05bb-9e6e-47b4-9ede-71541b8b4d0d","resolution":{"observed_at":"2026-08-02T22:34:16.093903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.216191Z","title":"Recent advances and future trends in vehicular communication systems: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.216191Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:8d5a10c22913dee790f82096e970700cbfa88b32b81ed263597e8327759f52d5","observation_id":"374ba54c-e49a-4153-9a02-3b7532b17dcb","resolution":{"observed_at":"2026-08-02T22:34:16.216191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.365192Z","title":"Multiuser resource control with deep reinforcement learning in iot edge comput- ing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.365192Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:ccf47f5e4c3a0d79487436b9e178cd77d45f1a65c9e68308f789e1f93be23ea1","observation_id":"dd203d4d-334f-4b85-8187-2b9b1989a1cb","resolution":{"observed_at":"2026-08-02T22:34:16.365192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.527546Z","title":"Deep reinforcement learning based resource allocation for v2v communications,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.527546Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:d8cbe833ca2c7cc819de6b388667b55d70a8e18611752868756f27a3c1bb3c1d","observation_id":"4cc0e15b-acfc-4ae4-af43-c86f058257f7","resolution":{"observed_at":"2026-08-02T22:34:16.527546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.599296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.599296Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:fd206244e79b934a9bf537449d65679c35613850e5ec2abd802863bc75900854","observation_id":"106749c0-e2ce-4b2d-93cc-88533a1678de","resolution":{"observed_at":"2026-08-02T22:34:16.599296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.661898Z","title":"Spectrum sharing in vehicular networks based on multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.661898Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:6a97a38b424e4eeffeb9097c0fe11799edde5dfdd162d6c6423bbbad9ec834ea","observation_id":"511f70b3-1e08-43aa-a109-56bc96060968","resolution":{"observed_at":"2026-08-02T22:34:16.661898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.707973Z","title":"Multi-agent RL enables decentralized spectrum access in vehicular networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.707973Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:c0790c3148b6b6376a1179559731abcc927e8681aa0da764ee73fe4c1f7df6eb","observation_id":"fbb8b2fa-a04a-416b-a21e-4a6446d2c666","resolution":{"observed_at":"2026-08-02T22:34:16.707973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.766409Z","title":"Multi-agent reinforcement learning-based decentralized spectrum access in vehic- ular networks with emergent communication,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.766409Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:436c5725394c250d3b3c480bb061733c6f4fba2163c88ecb0d154f6646f96843","observation_id":"3cb9e088-f01e-43b0-bf8b-e8502403d006","resolution":{"observed_at":"2026-08-02T22:34:16.766409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.825818Z","title":"Resource allocation in V2X communications based on multi-agent reinforcement learning with attention mechanism,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.825818Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:52ce876de9dc7e38cb12285e793b5657a617bf01fc420a55629a2cb56d36f4fb","observation_id":"982bb0da-cf4c-480c-9155-70b5c1cc87b4","resolution":{"observed_at":"2026-08-02T22:34:16.825818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:16.897576Z","title":"Mean-field aided multi-agent reinforcement learning for resource allocation in vehicular networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.897576Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:2199d86b3711eb5c826dc051f1a35b8384aef010890c8acb5abc8086837b0614","observation_id":"74fef6dc-c209-4b86-a522-151d46cd5c62","resolution":{"observed_at":"2026-08-02T22:34:16.897576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06518","last_updated":"2025-06-16T08:00:30Z","snapshot_observed_at":"2026-07-06T18:43:26.425575Z","submitted_at":"2024-07-09T03:14:11Z","title":"Graph Neural Networks and Deep Reinforcement Learning Based Resource Allocation for V2X Communications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06518","snapshot_observed_at":"2026-08-02T22:34:16.986345Z","title":"Graph neural networks and deep reinforcement learning based resource allocation for v2x communications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:16.986345Z"},"links":{"cited_paper":"/paper/2407.06518","citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:f908a1e541d4d1e71a7a7cbd7b4c36a5ac0bc8a0db5d0e2e87df590a3145e0d9","observation_id":"ac01e186-28d3-4e1f-ad11-5c21aa76f15e","resolution":{"observed_at":"2026-08-02T22:34:16.986345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.175140Z","title":"Meta-reinforcement learning based resource allocation for dynamic v2x communications,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.175140Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:1075464e94b8db5d37ddafb42eb1a68a6038121056b615920255f7c8d0f90e25","observation_id":"731b35d2-d8bf-493f-adc8-fe57b2b25cd8","resolution":{"observed_at":"2026-08-02T22:34:17.175140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.269895Z","title":"Multitimescale control and communications with deep reinforcement learning—part ii: Control- aware radio resource allocation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.269895Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:f1ccd5916a2a4adcac658edeec0ee1c71af599cc9eaba2d1aa26f1242f588545","observation_id":"10b5bb66-4620-4565-8cc3-9b10e507eb35","resolution":{"observed_at":"2026-08-02T22:34:17.269895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.389777Z","title":"A review of cooperative multi-agent deep reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.389777Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:4bc9f4c2dd995fefbecff37ac56bf8e640eb1857192bac34f48331f1abb027c4","observation_id":"7963d358-bd87-40f6-b64f-5b9962f01b18","resolution":{"observed_at":"2026-08-02T22:34:17.389777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-02T22:34:17.452139Z","title":"Bench- marking multi-agent deep reinforcement learning algorithms in cooper- ative tasks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.452139Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:8ef3335fc051de90862fc0f743dab82e94ca1f99e9aac37be58d36a353ce50d8","observation_id":"df126020-9847-4c4d-94d5-6dc1312ef6d7","resolution":{"observed_at":"2026-08-02T22:34:17.452139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T22:34:17.513122Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.513122Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:ecf780675898135d6077ca540a23fdda4a9730601e141b09cce5d28d16387fdb","observation_id":"3cced00c-6889-4909-a1d6-e9c04a97e1bb","resolution":{"observed_at":"2026-08-02T22:34:17.513122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.611716Z","title":"Deep reinforcement learning based resource allocation with heterogeneous qos for cellular v2x,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.611716Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:ac068adf31e63752c9a9403bbda36a1222febaabf739ac5d79f93ae2469dc8f3","observation_id":"3320a770-529f-4dbc-b0a6-571027f34d67","resolution":{"observed_at":"2026-08-02T22:34:17.611716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.673929Z","title":"Spectrum-energy-efficient mode selection and resource allocation for heterogeneous v2x networks: A fed- erated multi-agent deep reinforcement learning approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.673929Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:4a9408e05669ab1b262d5802a17e1948db0739039b29df0800d25efc33327d63","observation_id":"9a3779d8-374c-4d97-901a-1b71e5e04ff9","resolution":{"observed_at":"2026-08-02T22:34:17.673929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.746470Z","title":"A hybrid multi-agent reinforcement learning approach for spectrum sharing in vehicular networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.746470Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:1e67a641df79333186260e33edeb752ab92a38e4b6c24d4ab83fce1a3da7d60f","observation_id":"b764cb70-958b-469f-bc43-f3fcb156e0ac","resolution":{"observed_at":"2026-08-02T22:34:17.746470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.848633Z","title":"Federated reinforcement learning for resource allocation in v2x networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.848633Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:6a09e2d7ef3a8096f5ae2d169822bba30dca3f837066d46697bcdf98bdcad068","observation_id":"4d9c1c0a-e034-42f3-95f8-ced5e59cf4bb","resolution":{"observed_at":"2026-08-02T22:34:17.848633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:17.985066Z","title":"Semantic- aware resource allocation based on deep reinforcement learning for 5g- v2x hetnets,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:17.985066Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:13276672dd08d819020430e8d9642c4547538b7167b3b0e617afcb1a95d7b72f","observation_id":"49bb79f2-027a-42cc-a08c-18958143a13b","resolution":{"observed_at":"2026-08-02T22:34:17.985066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.064152Z","title":"Deep reinforcement learning for multi- objective resource allocation in multi-platoon cooperative vehicular networks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.064152Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:5a0d1d1ecfe850b1348b3dff3719d28da96c0567d7befaaa6bcc0b5f52124766","observation_id":"7360ce8d-3795-4b10-8e6c-16d6fad6459b","resolution":{"observed_at":"2026-08-02T22:34:18.064152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.179888Z","title":"Enabling adaptive optimization of energy efficiency and quality of service in nr-v2x communications via multiagent deep reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.179888Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:cf6ae16b8857ac98cf670df619be325c3b3cbfe061c35d422c8e100dcbcc9a54","observation_id":"01bacd2b-7915-4c8d-a8e2-11ed06589450","resolution":{"observed_at":"2026-08-02T22:34:18.179888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.300005Z","title":"Aoi-aware resource allocation for platoon-based c-v2x networks via multi-agent multi-task reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.300005Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:79091c7b5a72c6a4e6e42590049b03075adc5d7babb9fbc97d8493c0e76e469c","observation_id":"cf45f331-e31c-4e13-80a1-93390e7ff969","resolution":{"observed_at":"2026-08-02T22:34:18.300005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04672","last_updated":"2025-05-26T12:55:04Z","snapshot_observed_at":"2026-08-06T15:49:04.305390Z","submitted_at":"2024-11-07T12:55:35Z","title":"Semantic-Aware Resource Management for C-V2X Platooning via Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04672","snapshot_observed_at":"2026-08-02T22:34:18.388395Z","title":"Semantic-aware resource management for c-v2x platooning via multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.388395Z"},"links":{"cited_paper":"/paper/2411.04672","citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:2833b0bd34a01eccb5342d96173c608fefb0e5bcc896cd6e45459dbaca0298d1","observation_id":"b0d3b2ca-6998-4be9-9d08-749536e122d2","resolution":{"observed_at":"2026-08-02T22:34:18.388395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.491079Z","title":"Deep reinforcement learning for autonomous internet of things: Model, ap- plications and challenges,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.491079Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:f93849c8791610e79c089e90e097cf10b3944e438ff37dcb1d40075187ec9113","observation_id":"531f6618-ee62-4690-b966-43f7a7cc73d4","resolution":{"observed_at":"2026-08-02T22:34:18.491079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.617606Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environ- ments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.617606Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:caff10faee60c9f2c89a96a08685b12bdfccd548631190394770d798e43f6c86","observation_id":"74ad8ce7-7220-41e9-ad32-70887933cb06","resolution":{"observed_at":"2026-08-02T22:34:18.617606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.746179Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.746179Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:dda4102380db499614ce13c79a92f2e60b398d3b4140797a2687e2793888eeb2","observation_id":"0304c7ea-5099-4db4-8b3c-13e24a6d7f3a","resolution":{"observed_at":"2026-08-02T22:34:18.746179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.826908Z","title":"Technical Specification Group Radio Access Network; Study LTE- Based V2X Services; (Release 14),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.826908Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:26f7aff08fa798bf3123374b578c6d4906d2e856e2acf5475cfe901a275520a9","observation_id":"7f87d410-b139-483b-8a1c-ba2f563cd3b3","resolution":{"observed_at":"2026-08-02T22:34:18.826908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:18.883970Z","title":"TR 103 766, no","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:18.883970Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:c19816f83952b518afdabba813a045e51ea5e0fb9db1468bdb4ca4f60748b17f","observation_id":"b9bb1224-a219-4aa6-a431-c24ecfb621e7","resolution":{"observed_at":"2026-08-02T22:34:18.883970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.099121Z","title":"Delay- optimal dynamic mode selection and resource allocation in device-to- device communications—part ii: Practical algorithm,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.099121Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:14421577475b6d0bb0f53b1177f389da8de7c7b60442ca2c65d1fe89f4a93544","observation_id":"17e50fc2-07fd-4da3-aedc-44c9e5989f8a","resolution":{"observed_at":"2026-08-02T22:34:19.099121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.227885Z","title":"Lenient learning in independent-learner stochastic cooperative games,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.227885Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:d40d364b238920f24092d8fb887bb427c955fe73fae6bed6c2a256efcbff4c24","observation_id":"ff5f13eb-31a7-42d6-8734-d8ed17dfd325","resolution":{"observed_at":"2026-08-02T22:34:19.227885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.418454Z","title":"Leveraging procedural generation to benchmark reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.418454Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:76866bdff22073ddf8968136bf63eafdbe6ffa75df57429f8ffcb2dab44a9b10","observation_id":"c4cd68c6-5569-40cd-b67b-0fbc82d50387","resolution":{"observed_at":"2026-08-02T22:34:19.418454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.542941Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.542941Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:3f6ccea6bc90c7ff7195b63ff4ca3d72b4c06317aa19b429b232dd22753dc061","observation_id":"3921ecd1-545a-474f-be8d-e190ede9d683","resolution":{"observed_at":"2026-08-02T22:34:19.542941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.650964Z","title":"Hysteretic q-learning: an algorithm for decentralized reinforcement learning in cooperative multi-agent teams,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.650964Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:4df68f9ca375025d4cbf779ee23cda7dabb374f39fb54b212c47eced56ab3335","observation_id":"e406cb7e-4987-4d1d-9dc0-4edb0a6e72c0","resolution":{"observed_at":"2026-08-02T22:34:19.650964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.700786Z","title":"Asynchronous methods for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.700786Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:5ca8bafeb13ece28cde142719e5d62f1ec7a33e1098d7bd22b25e39f868cf5da","observation_id":"2903a1ad-14ec-4221-acec-3c7a8e3cd478","resolution":{"observed_at":"2026-08-02T22:34:19.700786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.775302Z","title":"Value-decomposition networks for cooperative multi-agent learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.775302Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:0f9b6297170269b96fa6a89dd62599119a1e3e3a1669d77e6a6de49e3347d28f","observation_id":"d2be844e-5413-44bd-8d73-b66ede30eceb","resolution":{"observed_at":"2026-08-02T22:34:19.775302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.853730Z","title":"Qmix: Monotonic value function factorization for deep multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.853730Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:c8572fcf1ae25b4ffe045c734814a0030c59344d866642dce7cec2d5fa5dc955","observation_id":"e221153c-c6f8-404e-b5da-56b312ed82ad","resolution":{"observed_at":"2026-08-02T22:34:19.853730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:19.938432Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:19.938432Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:56d9ebd6f43b522d0108869434d0f525445b2e49f950f62cba3ddd4aa39586b9","observation_id":"c355a984-4547-42ea-b39f-af769ff4e5ec","resolution":{"observed_at":"2026-08-02T22:34:19.938432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:34:20.119341Z","title":"Performance analysis of device-to-device communications with dynamic interference using stochastic petri nets,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:20.119341Z"},"links":{"citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:dc7366e0aae7b4392c77189ae65e56c3e42cad9cbdf18b1b5662bc49a86de883","observation_id":"37ad47fb-712a-4195-8c13-6ba7904afede","resolution":{"observed_at":"2026-08-02T22:34:20.119341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01955","last_updated":"2022-11-04T06:16:11Z","snapshot_observed_at":"2026-07-06T10:46:11.856932Z","submitted_at":"2021-03-02T18:59:56Z","title":"The Surprising Effectiveness of PPO in Cooperative, Multi-Agent Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01955","snapshot_observed_at":"2026-08-02T22:34:20.029978Z","title":"Available: https://arxiv.org/abs/2103.01955","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T22:34:20.029978Z"},"links":{"cited_paper":"/paper/2103.01955","citing_paper":"/paper/2603.06607"},"observation_digest":"sha256:2c735ec5a991d1d202d7a7a9cb614c1cf4afb106c64667e407789827c0687105","observation_id":"c60c4bf8-78d6-4bb4-ae37-01190cc2feb3","resolution":{"observed_at":"2026-08-02T22:34:20.029978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.06607","last_updated":"2026-07-06T14:06:03Z","latest_version":2,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-08T02:50:11.631250Z","submitted_at":"2026-02-18T14:46:56Z","title":"Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2603.06607."}