{"as_of":"2026-08-19T19:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85fcbf37c1facd0ee4119be93e9bc3776b391becbb5d28a0297606e267018ba7","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:35:49.596258Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T22:56:33.073457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T22:58:23.930563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"cited_work":{"arxiv_id":"2504.15425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.15425","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Solving multi-agent safe optimal control with distributed epigraph form marl","venue":null,"work_id":"e3a5084e-ba48-4deb-a8ab-b7469aa47d54","year":2025},"citing_paper":{"arxiv_id":"2604.00429","last_updated":"2026-04-12T23:45:52Z","snapshot_observed_at":"2026-08-13T07:35:24.678231Z","submitted_at":"2026-04-01T03:15:49Z","title":"Distributed Safety-Critical Control of Multi-Agent Systems with Time-Varying Communication Topologies","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T22:56:33.073457Z"},"links":{"cited_paper":"/paper/2504.15425","citing_paper":"/paper/2604.00429"},"observation_digest":"sha256:6cf09839abdcfbedf39d49784063470c61733e0d5c32eee0a399212998b8d4bc","observation_id":"e8d1989e-45f5-44b0-bf8c-d9b029676de5","resolution":{"observed_at":"2026-05-13T22:58:23.933705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.15425/citation-record","integrity":"/paper/2504.15425/integrity","json":"/paper/2504.15425/citation-record.json","paper":"/paper/2504.15425"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.100505Z","title":"Constrained policy optimization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.100505Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0eb1986c7516af686bf78e5878ed7e6e46a8c0fc82ffb04bc55883bb908f6ff9","observation_id":"021ed894-e2a8-4fad-af50-233bc9b42bc9","resolution":{"observed_at":"2026-08-16T11:35:49.100505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.105943Z","title":"Learning transferable cooperative be- havior in multi-agent team","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.105943Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a5aa7a9eca41e00a950c5f8ad75b3ccf0c150902a54ab978f8371a9312f9dfc0","observation_id":"3f762109-487a-40e7-a875-1da5a0add65d","resolution":{"observed_at":"2026-08-16T11:35:49.105943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.111335Z","title":"Constrained Markov decision processes","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.111335Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4f41fff8d418536e561469fba54bf066aaf47cc26a9a312090a2ee28d7c7c38f","observation_id":"f011d933-34b0-4ec8-956f-40751c62e234","resolution":{"observed_at":"2026-08-16T11:35:49.111335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.116234Z","title":"Casadi: a software framework for nonlinear optimization and optimal con- trol","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.116234Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5499248baaf3a29682cc8d73d7905d458a25165b6e0a16fd3dd7c2f7917628a7","observation_id":"bddfa60f-aab9-4940-a474-151512c7062a","resolution":{"observed_at":"2026-08-16T11:35:49.116234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.121126Z","title":"Hamilton-jacobi reachability: A brief overview and recent advances","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.121126Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0dfa547f92146d2e75bca427313f65dd68be943e47acdf5838b88a8177da075f","observation_id":"ba6db136-ebf3-4e72-8c1b-16766ba2e162","resolution":{"observed_at":"2026-08-16T11:35:49.121126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.125942Z","title":"Dynamic programming and optimal control: Volume I, volume 4","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.125942Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:da71e5d73147f00cc29c76346b051f69a4c5a1c55d3c58296c1cd2dcb39c4daa","observation_id":"66e5c626-3936-4ea5-98fb-f527b5901967","resolution":{"observed_at":"2026-08-16T11:35:49.125942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.131262Z","title":"Synthesis of minimum-cost shields for multi-agent systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.131262Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:32710d074ea2ed6efd701a558977640c6d1a476fb44b25b06e2b56931b8b5870","observation_id":"647f9e09-641c-4aa1-b5cb-6078b0a34493","resolution":{"observed_at":"2026-08-16T11:35:49.131262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.136145Z","title":"An actor-critic algorithm for constrained markov decision processes","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.136145Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7101e0c2f47b67bb66ebbc92365b4dc8d7c7b96f5f52ea116ec9004d31c6a319","observation_id":"01d8c8e2-5ed1-4d53-b4da-b702c9846195","resolution":{"observed_at":"2026-08-16T11:35:49.136145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.141464Z","title":"Stochastic Approximation: A Dynamical Systems Viewpoint, volume 48","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.141464Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ee85ea555feae8450de0e4317834471c59dfc71e5ba4d4c88a1e4adcc445674f","observation_id":"387cca71-61aa-4619-9945-16a5dd173f73","resolution":{"observed_at":"2026-08-16T11:35:49.141464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.146263Z","title":"Convex optimization","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.146263Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e575f126ab1150df6093380b17177ff6e5d68eb544e2c9fb3cd8e15f93f7692e","observation_id":"f2eede24-1a56-4d49-8870-c9075d9289b3","resolution":{"observed_at":"2026-08-16T11:35:49.146263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.12553","last_updated":"2021-03-23T13:54:21Z","snapshot_observed_at":"2026-08-17T16:32:37.246900Z","submitted_at":"2021-03-23T13:54:21Z","title":"Safe Multi-Agent Reinforcement Learning through Decentralized Multiple Control Barrier Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.12553","snapshot_observed_at":"2026-08-16T11:35:49.151496Z","title":"Safe multi-agent reinforcement learning through decentralized multiple control barrier functions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.151496Z"},"links":{"cited_paper":"/paper/2103.12553","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5084064969b3fd7d1b89c8e27d3e21d47bc6a39121f722b163f4f10e2b8ff169","observation_id":"b3dae811-fdde-4419-b16c-879328c11f8f","resolution":{"observed_at":"2026-08-16T11:35:49.151496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.156876Z","title":"A new hybrid quadratic/bisection algorithm for finding the zero of a nonlinear function without using derivatives","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.156876Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:19bdbdde76158148409cf554a6137b2f38737bc01dfc681b1eb74d617ff0543e","observation_id":"47be9f9e-05d5-44dd-8c33-ac89b9305b93","resolution":{"observed_at":"2026-08-16T11:35:49.156876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.161771Z","title":"Socially aware motion planning with deep re- inforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.161771Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:954af2383d4253d0b22fdc4f3394cb5aa1cbc464a422e66aab17ecf478a2a430","observation_id":"1182b6e9-eee5-4d80-9d2c-bf4c05b5cc3c","resolution":{"observed_at":"2026-08-16T11:35:49.161771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.166199Z","title":"Decentralized non-communicating multiagent col- lision avoidance with deep reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.166199Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5aa6764d03c928e2c83fe352e1bb7c4468416b6801062604093c8d0844c916c8","observation_id":"4924cc63-5136-465e-8dee-b868114ab8ec","resolution":{"observed_at":"2026-08-16T11:35:49.166199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.170705Z","title":"On the duality gap of constrained cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.170705Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b6063d8d2e488f263dcfdd0340cab5f252c5641874c0e397cd64dc76985076b8","observation_id":"2986275c-4cda-40fe-b0ac-f6f90ac66d74","resolution":{"observed_at":"2026-08-16T11:35:49.170705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.175559Z","title":"Computational aspects of distributed optimization in model predictive control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.175559Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:9accafaa456646f9b1369874ceeca987bc061f21d280a350a156ed69892933c7","observation_id":"dfd586fa-ea56-4f86-b855-92705b94571f","resolution":{"observed_at":"2026-08-16T11:35:49.175559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.180383Z","title":"De- tecting, localizing, and tracking an unknown number of moving targets using a team of mobile robots","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.180383Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:58a0dda6fdfe8ced43db1a03b0b3a6405df3abea163aa17f6dac97649a472a9e","observation_id":"e1c51361-7511-40ce-b559-ece92db3f9bd","resolution":{"observed_at":"2026-08-16T11:35:49.180383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.185205Z","title":"Provably efficient gener- alized lagrangian policy optimization for safe multi-agent reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.185205Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5d5403141a2f3014aeeacfde6dbc6ed240827adbc49678b49be10362b9efb750","observation_id":"357a9e3c-ec56-4522-860a-ca97b7967865","resolution":{"observed_at":"2026-08-16T11:35:49.185205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.11196","last_updated":"2021-02-02T18:30:53Z","snapshot_observed_at":"2026-08-16T18:49:44.304654Z","submitted_at":"2021-01-27T04:27:06Z","title":"Safe Multi-Agent Reinforcement Learning via Shielding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.11196","snapshot_observed_at":"2026-08-16T11:35:49.190136Z","title":"Safe multi-agent reinforcement learning via shielding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.190136Z"},"links":{"cited_paper":"/paper/2101.11196","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:04109157eb2bb84d61498faa85faed5b9ac620c75bf4f412ff2d79b56ad0ce49","observation_id":"81d691fe-8670-41e6-b37e-f155dddd9993","resolution":{"observed_at":"2026-08-16T11:35:49.190136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.194900Z","title":"Safe multi- agent reinforcement learning via shielding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.194900Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c125a0a28d0b1bdf7251d4593a45b1ac5f47bc289c5b362c323d15453a6bb4f0","observation_id":"e0024367-a868-409e-8988-6a3c1dbe99a2","resolution":{"observed_at":"2026-08-16T11:35:49.194900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.199462Z","title":"Mo- tion planning among dynamic, decision-making agents with deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.199462Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f2409635957eb004bd80d4ab0137812476fea9e1f001cfd56eb2c49552075343","observation_id":"5101e1bb-d11f-46c4-b075-44e424cad64b","resolution":{"observed_at":"2026-08-16T11:35:49.199462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.955434Z","title":"A distributed model predictive control strategy for constrained multi- agent systems: The uncertain target capturing scenario","venue":null,"work_id":"b0fcd561-1333-4ef0-b0b0-f9113b20fe6f","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.203864Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4293c75a6447ab0a60a582f7e41c911b2e45726ebaad28ea69698ec5542df1f3","observation_id":"a2625dc9-4098-48a1-a000-2456fb48fdf1","resolution":{"observed_at":"2026-08-16T11:35:50.960217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.939055Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":"81a6d375-e9da-42c8-ada3-e6c1f249683b","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.208585Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a9a5937346764f4d8ca43ed34b7602378ec14d6d8a01887151062fe7b3dfa42a","observation_id":"a37f3fec-48f4-496b-9e91-42bd4d4dca69","resolution":{"observed_at":"2026-08-16T11:35:50.944198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.213377Z","title":"Iterative reachability estimation for safe reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.213377Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:2673ae9d76cb8b74854f23c5df67230a1b8ad868019b585fbc43c21490c82079","observation_id":"a36e666d-7a33-4222-aba9-4073d813675b","resolution":{"observed_at":"2026-08-16T11:35:49.213377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.911026Z","title":"Learning safe control for multi- robot systems: Methods, verification, and open chal- lenges","venue":null,"work_id":"dfb644d2-c9b4-494c-8280-5692390b34c0","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.218177Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:08acdc459e15818cb96f9025a53fac33ad6d30f45a72536d3f82b4c94531ba30","observation_id":"3ca00963-31c1-42f3-99d1-b440454e11c5","resolution":{"observed_at":"2026-08-16T11:35:50.916330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.893666Z","title":"A reinforce- ment learning framework for vehicular network routing under peak and average constraints","venue":null,"work_id":"5963e79d-2ef8-4db0-86f1-5569428db8fa","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.222823Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c09c1d9856acbf85ce3171cded384e4f1b54698226572c7cc152cce6d1a21da4","observation_id":"2e19ab2a-784e-41e9-9806-908398d7a7fc","resolution":{"observed_at":"2026-08-16T11:35:50.899242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.877036Z","title":"Crazyflie 2.0 quadrotor as a platform for research and education in robotics and control engineering","venue":null,"work_id":"cc98aaa4-0956-4a0e-8ac4-94f8aa84e00c","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.228778Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f00658ba60aa2cd3cf485a88044a7786d37ae43b562b666a4c79e3a5af7d2cb9","observation_id":"7e679174-932b-4bb9-9733-7274dc2c81d5","resolution":{"observed_at":"2026-08-16T11:35:50.882587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.234123Z","title":"Snopt: An sqp algorithm for large-scale constrained optimization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.234123Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0cbff42c743f89028ac2b626cdb83cfd7b094b917c1ef3d0a1e6d048a2e61edd","observation_id":"6f6e2a00-a966-4689-a670-3e1230b068cd","resolution":{"observed_at":"2026-08-16T11:35:49.234123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.847438Z","title":"Nonlinear model predictive control: theory and algorithms","venue":null,"work_id":"f96afe2d-e0a4-4321-8ed9-df460fed257f","year":2013},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.239025Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c262d4c6a7e1e4c3487a7f003bd0fa3fd2de751c009cc38738423a91de98eb2b","observation_id":"c7c38f09-8592-41a2-b2e7-97f7db9891a4","resolution":{"observed_at":"2026-08-16T11:35:50.853203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02793","last_updated":"2022-02-10T07:08:47Z","snapshot_observed_at":"2026-08-18T00:47:47.542907Z","submitted_at":"2021-10-06T14:17:09Z","title":"Multi-Agent Constrained Policy Optimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02793","snapshot_observed_at":"2026-08-16T11:35:49.243705Z","title":"Multi-agent constrained policy optimisation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.243705Z"},"links":{"cited_paper":"/paper/2110.02793","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c45fdbc89d91779a73a5ca7ed9a0fb5cfc8a11bea6612bb00a9771f639efc58c","observation_id":"cd1c5b7b-32eb-4073-a64f-0fea3ec9c907","resolution":{"observed_at":"2026-08-16T11:35:49.243705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-16T16:58:50.532049Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-16T11:35:49.248824Z","title":"A review of safe reinforcement learning: Methods, theory and applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.248824Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:06d54a67aa3ff984d18094d2d1d9e716e4ec5b8970b40ba901893f43779e5081","observation_id":"75bcca73-1d38-4d39-b5ae-6474eddf8218","resolution":{"observed_at":"2026-08-16T11:35:49.248824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.827715Z","title":"Safe multi-agent reinforcement learning for multi-robot control","venue":null,"work_id":"3073c058-db53-491e-bfb4-69c453b7ae8d","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.253790Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:100d3aa6544830586ce197ff510a1389e880d8d7cfebef3cace1a376996e7056","observation_id":"df65dcad-5e97-4d33-84b7-8389674db06d","resolution":{"observed_at":"2026-08-16T11:35:50.834594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.811968Z","title":"Coordinated reinforcement learning","venue":null,"work_id":"817460c9-78ac-4578-b8f0-cbf4580503c3","year":2002},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.258380Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f8ce7db1ac5d4f26a024d4a16cef5e39cb02e055b248cc3a539ca49621f436db","observation_id":"7fe7dc21-ca19-41c5-a1c5-f1443941b0a2","resolution":{"observed_at":"2026-08-16T11:35:50.816795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.794691Z","title":"Deep recurrent q-learning for partially observable mdps","venue":null,"work_id":"a92a6803-7339-4de3-87d7-0171f624ad0e","year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.263244Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:85951227a11c02dde014c69f937d9d19ab7ebbbb92f775bb23cb5f4f5115a8f4","observation_id":"bce72a09-d609-4b10-9671-4cce7b9d10ed","resolution":{"observed_at":"2026-08-16T11:35:50.800028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.777800Z","title":"Autocost: Evolving intrinsic cost for zero-violation reinforcement learning","venue":null,"work_id":"fb31fa0a-4921-4185-ac30-9a7366b7ae27","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.269034Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:78040c973ca7c6a3248a028e744ea37cc4b74be24158208997be672ea23f8b0d","observation_id":"efc781f4-8330-4f9e-8ab0-b0fa59a789d6","resolution":{"observed_at":"2026-08-16T11:35:50.782922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.759631Z","title":"Safedreamer: Safe reinforcement learning with world models","venue":null,"work_id":"2275e54a-3d34-453c-9c59-42698e0c624c","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.273968Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3dd790d8f8de3fd0de81dc8d72b6c4504ff03213e72d2e880db772032b956f12","observation_id":"60b7bea2-7cf5-4183-ab78-6e180f5141a5","resolution":{"observed_at":"2026-08-16T11:35:50.765390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.741260Z","title":"Distributed optimization in multi-agent robotics for industry 4.0 warehouses","venue":null,"work_id":"bbd89a06-820f-423e-86af-5c66fb4116f5","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.280957Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:649de528964604068ba516bcc8144d3ec3186087721347ac2664b16b289cdab2","observation_id":"bcef9d51-07e5-449c-8798-89fdffd4bdb4","resolution":{"observed_at":"2026-08-16T11:35:50.747003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.721350Z","title":"Cmix: Deep multi- agent reinforcement learning with peak and average con- straints","venue":null,"work_id":"33a3ad4b-10bc-4021-adfa-f4885d5dae6f","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.286188Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e7a1113a48af1ef2d1934406243cde2af50c721ad919983720711939fa03f9fb","observation_id":"ea097793-3e3b-4905-be52-a3a255c5c929","resolution":{"observed_at":"2026-08-16T11:35:50.728160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.699802Z","title":"Towards optimally decentralized multi-robot collision avoidance via deep reinforcement learning","venue":null,"work_id":"dfd5090e-ef92-4017-a201-877fc08b9e3a","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.290715Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:010731af571b4e01e4b59be4f7224f0bfd40e8ad79c7f67524361c78fad1b16e","observation_id":"1406ba9c-9992-4145-9e9c-3710efa7d9fc","resolution":{"observed_at":"2026-08-16T11:35:50.705889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.682371Z","title":"Multi-agent actor- critic for mixed cooperative-competitive environments","venue":null,"work_id":"43ecf879-347d-4d96-b99f-81d47790ffa7","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.295450Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:dc8f0e574269d9a7ff56a85d96f58863cb2f850916d3aa25e8d24eab9e085087","observation_id":"08f7fcea-19d9-480d-a403-5c4ed1d81e61","resolution":{"observed_at":"2026-08-16T11:35:50.687627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.664994Z","title":"Decentralized policy gradient descent ascent for safe multi-agent reinforcement learning","venue":null,"work_id":"31d3e1ee-eaef-481c-a6c0-d50445d261b9","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.300993Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:a6bb258c590da90d7d0344cfb69aab1203b8a66ed9c346212ade855463ceadfa","observation_id":"1ec2c0d6-124d-4e49-8d1c-7e4796f40a9c","resolution":{"observed_at":"2026-08-16T11:35:50.670639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.647773Z","title":"Trajectory generation for multiagent point-to-point transitions via distributed model predictive control","venue":null,"work_id":"a5c23dc2-c37a-4d87-86c8-15bdb00803ab","year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.306462Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:abe8e3f7983566e2aa2f068c65a4c86f25228466fc7ad8f320f7069e510bedad","observation_id":"37f2e7e6-78ba-46cb-8ac7-34d294efe1ca","resolution":{"observed_at":"2026-08-16T11:35:50.653222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.629210Z","title":"Online trajectory generation with distributed model predictive control for multi-robot motion planning","venue":null,"work_id":"c3fcc92d-c32f-486f-b9fe-d77aa07679a3","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.311335Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:dcfc83cb43778435b12ef93971d0e72cf4a6f76e4d0aedd80b08db41c32c950a","observation_id":"94b03caa-0cb1-4e78-8c51-3b1b3280dc16","resolution":{"observed_at":"2026-08-16T11:35:50.634565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.316420Z","title":"On reachability and minimum cost optimal control","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.316420Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:35ea002d10bf0fac8e2e4829e3560f771101dadd4c760563cd4d3e30618ae9c0","observation_id":"3d62944b-59f5-43d1-a914-1388f859acdf","resolution":{"observed_at":"2026-08-16T11:35:49.316420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.10868","last_updated":"2017-05-30T21:08:16Z","snapshot_observed_at":"2026-08-14T20:57:08.544504Z","submitted_at":"2017-05-30T21:08:16Z","title":"Lifelong Multi-Agent Path Finding for Online Pickup and Delivery Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.10868","snapshot_observed_at":"2026-08-16T11:35:49.321247Z","title":"Lifelong multi-agent path finding for online pickup and delivery tasks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.321247Z"},"links":{"cited_paper":"/paper/1705.10868","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:202f1071fe1006c66c04226038320fd3589a3833a445bac73ea99e40d63d254f","observation_id":"a67092fb-f45b-4168-8ce2-1c802594f8d9","resolution":{"observed_at":"2026-08-16T11:35:49.321247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.599724Z","title":"Hamilton–jacobi formulation for reach–avoid differential games","venue":null,"work_id":"f9c677da-b627-49af-b7b0-11d29d35a416","year":2011},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.326900Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5484bd67dd0e4e0da023982d1b41a52bffc52b485fade683a3e7bf6327a8d827","observation_id":"93311ed5-1199-4c60-9bf5-029f404aa922","resolution":{"observed_at":"2026-08-16T11:35:50.605556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.582214Z","title":"Safe value functions","venue":null,"work_id":"2dbcd26b-a714-4b65-bca2-b58f17c5a558","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.331833Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c1b78f951403f8087d0b972ec577f5e9e9b44f33628f0994080d2ea047ee2c83","observation_id":"bfd02cfa-a22b-4953-be02-47eba0a8793a","resolution":{"observed_at":"2026-08-16T11:35:50.587653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.564698Z","title":"Shield decentralization for safe multi-agent reinforce- ment learning","venue":null,"work_id":"875abaf3-0d51-48e1-ac22-1c6afdf07c6a","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.337215Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:293ab7c11ff28c01a0c83d045b19a6f4deee8f0816c45dbc173380bba83b0409","observation_id":"bc854208-b398-4db6-beec-579021b599d8","resolution":{"observed_at":"2026-08-16T11:35:50.570150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.342067Z","title":"A time-dependent hamilton-jacobi formulation of reachable sets for continuous dynamic games","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.342067Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b0e7803617bed3901f4e3756ea459928529b23980dccabfb28bf67c9849240b9","observation_id":"140a3280-0ba2-4594-8868-3c5926e56dfd","resolution":{"observed_at":"2026-08-16T11:35:49.342067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.535216Z","title":"Distributed model predictive safety certification for learning-based control","venue":null,"work_id":"335a46fe-3d2f-4424-827b-fd4baa4d3e2f","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.346763Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:16cbe60dcb5278ca2f4d52028ad8f6c8b78ed698fb877e3d6f538d4751abcde9","observation_id":"e0fec4a7-ff8b-4d82-a8bc-93d754141da9","resolution":{"observed_at":"2026-08-16T11:35:50.540428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.518601Z","title":"Scalable multi-agent reinforcement learning through intelligent information aggregation","venue":null,"work_id":"0ee21788-c497-43ba-b1fc-ff4dfe373af2","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.351927Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ff748abfc854a945318c19faee5cc9a6cd2728ab49e4474d9b185c2c89b9e268","observation_id":"2f02698a-e874-44db-974c-e81feffb43b8","resolution":{"observed_at":"2026-08-16T11:35:50.523861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.500702Z","title":"Distributed optimization for control","venue":null,"work_id":"0b846216-2aef-4090-9535-90798214df3d","year":2018},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.356555Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:324c916ed3b9e11b68a3eeeb02872e0c3a833700846f89bd0a405b734c81488a","observation_id":"fd4865da-e1d0-4b21-a8d3-347e590770d3","resolution":{"observed_at":"2026-08-16T11:35:50.506329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.361981Z","title":"Numerical opti- mization","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.361981Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:20d7b2827456e6c99d8d9c116d7aeb02a129f935b573b22d816fdc0e28183521","observation_id":"a9691ad1-2670-49cf-b45e-2c22cdba0e9c","resolution":{"observed_at":"2026-08-16T11:35:49.361981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.474048Z","title":"Facmac: Factored multi- agent centralised policy gradients","venue":null,"work_id":"10d8b399-87af-4bd0-a32a-f890f2ab3e03","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.366973Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0499aabfe87347bb0f4c15829200ea3971e82278c3b29a8448777b0d1c44fa58","observation_id":"13192686-87fe-4a3b-9a5c-6f1a74d3a50f","resolution":{"observed_at":"2026-08-16T11:35:50.479369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10658","last_updated":"2022-06-07T20:30:04Z","snapshot_observed_at":"2026-08-16T17:19:38.234420Z","submitted_at":"2022-02-22T03:57:23Z","title":"Decentralized Safe Multi-agent Stochastic Optimal Control using Deep FBSDEs and ADMM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10658","snapshot_observed_at":"2026-08-16T11:35:49.372051Z","title":"Decentralized safe multi- agent stochastic optimal control using deep fbsdes and admm","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.372051Z"},"links":{"cited_paper":"/paper/2202.10658","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:05d231e7a062a1ec40378cbce3d916e9935dfaedf89f9698f534a9a00c2081f3","observation_id":"21340052-cdf4-4616-b3b5-61c0855e9881","resolution":{"observed_at":"2026-08-16T11:35:49.372051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.457520Z","title":"Learning safe multi-agent control with decentralized neural barrier certificates","venue":null,"work_id":"1d49f7c1-f829-4eec-9620-acb1fff295df","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.377313Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4b2aa12e07cd5a75f6450275f02ab1c8647666adf1b7654dde0944a67f5a0102","observation_id":"aabf5350-5c2b-4d98-8168-1bd78439b3fb","resolution":{"observed_at":"2026-08-16T11:35:50.462917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.441444Z","title":"Weighted qmix: Expanding monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"ed64febe-721b-4fd3-9b0b-841691a56c0b","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.382001Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:f94722ca943e036c5770b360f8e87704e13d104534fef3dabb72983c919b78d4","observation_id":"f2d235d6-6442-4c49-b465-007add8b0b91","resolution":{"observed_at":"2026-08-16T11:35:50.446467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.425329Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":"843ff2e0-9a81-47d2-aa3e-ca8fa3452ccb","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.386675Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e664b968188510dee926f113e27ef1f1a70b76f5c21b38b5b24b4272833fd073","observation_id":"9146e6a4-38c0-47b9-b853-b50494f6c11c","resolution":{"observed_at":"2026-08-16T11:35:50.430474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.409343Z","title":"A stochastic approx- imation method","venue":null,"work_id":"f9c12aca-c737-424f-9d74-47cccfc6899d","year":1951},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.391565Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e6f41b9d9eefa778e33a1f12cc994e3289a19c5b37e6a2ffc2473970779d0a3b","observation_id":"bd3fb1fe-ecc5-4994-8921-57747eb556e1","resolution":{"observed_at":"2026-08-16T11:35:50.414429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.392837Z","title":"Con- strained markov decision processes via backward value functions","venue":null,"work_id":"4d45caa7-c20e-45e2-8214-c0326b0a860f","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.396466Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:465bab1c6c124ac108da9e5ab003064dfe7e440a75dfcfc6f7c9681eacbf93d0","observation_id":"3c9c3079-afe6-4d49-845b-79ebf0a70db0","resolution":{"observed_at":"2026-08-16T11:35:50.398173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.375701Z","title":"Trust region policy optimiza- tion","venue":null,"work_id":"4a12bc7c-3f4c-4688-b115-83eeaffd6a36","year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.401269Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:fa3b1da14fef0e1d98fdccc4cf2ef7d5616aa706543b8c10f875da9a1ea6d51b","observation_id":"d6075347-e324-4dba-8847-a101ca763e47","resolution":{"observed_at":"2026-08-16T11:35:50.381182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-16T11:35:49.405908Z","title":"High-dimensional continuous control using generalized advantage estimation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.405908Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:c54ccca44246e427d764a1c434a5aa391d3fc4790db872f0f52183f18120e7b5","observation_id":"3b10c4ad-aecd-42e6-93e6-5b509e001dc4","resolution":{"observed_at":"2026-08-16T11:35:49.405908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T11:35:49.411092Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.411092Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:9537889989a08ceedb9605f761c98734cae9ad6568e50d01c20ff0ebb0c58493","observation_id":"fee63235-7e9a-4da2-a553-945bc6e6ac5b","resolution":{"observed_at":"2026-08-16T11:35:49.411092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.358411Z","title":"Multi-agent motion planning for dense and dynamic environments via deep reinforcement learning","venue":null,"work_id":"887fc0d9-6856-492a-87b1-e8aa67ad5bcf","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.415932Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d7de88c6999189c7c9c612b4267b860d2b539c3c43d9471f286475f73fb28e9a","observation_id":"3adb61f4-599e-4493-8fef-ffab520f8d3c","resolution":{"observed_at":"2026-08-16T11:35:50.363450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03509","last_updated":"2021-05-10T02:23:20Z","snapshot_observed_at":"2026-08-11T19:52:55.524234Z","submitted_at":"2020-09-08T04:04:04Z","title":"Masked Label Prediction: Unified Message Passing Model for Semi-Supervised Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03509","snapshot_observed_at":"2026-08-16T11:35:49.420858Z","title":"Masked label predic- tion: Unified message passing model for semi-supervised classification","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.420858Z"},"links":{"cited_paper":"/paper/2009.03509","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:3db29b2897d69ce915b0b75b850e40e13e93fe6d8231e3641568ac875a5e1d10","observation_id":"41fad7e6-d630-4b0c-ba21-c3394c99f9dd","resolution":{"observed_at":"2026-08-16T11:35:49.420858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.341992Z","title":"Solving stabilize-avoid optimal control via epigraph form and deep reinforce- ment learning","venue":null,"work_id":"f37d5a52-71c3-479e-b00c-ea91c9db4613","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.426325Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d03ced8cfb8ca26ba14a943f817ee2932d9bf3050cede7c1fbd41fc5a51e7c30","observation_id":"1309f659-a663-49a7-8ca9-119b5083d7bb","resolution":{"observed_at":"2026-08-16T11:35:50.347386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.325666Z","title":"Solving minimum-cost reach avoid using reinforcement learning","venue":null,"work_id":"806d021e-2fbf-4857-94f6-f7c09d688c17","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.431478Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:20a9c039d8eb18224c5a761b706f16b48cd0db3ce185bfd3714d9a669702bf5d","observation_id":"29aebdd6-f22a-4bed-ab12-78370cd16582","resolution":{"observed_at":"2026-08-16T11:35:50.330772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.306265Z","title":"Predictive control of aerial swarms in cluttered environ- ments","venue":null,"work_id":"77ac596f-959c-4d6d-9426-039d1934f57c","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.436382Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:deff7ef78b11c77d8ea7315c27f2f54fe52fece7fdf9cd2a1ceeacd032c7d054","observation_id":"bf9028ad-636b-40e7-baee-5aa78a81ff94","resolution":{"observed_at":"2026-08-16T11:35:50.311938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-16T11:35:49.441863Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.441863Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ab07664d192120b423d1b7dbd00c9055168e69627e43bda5a20b2a618b5b341f","observation_id":"1926dfd9-129d-44d3-9ebb-4915cc2c9790","resolution":{"observed_at":"2026-08-16T11:35:49.441863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.288705Z","title":"Mankowitz, and Shie Mannor","venue":null,"work_id":"4c0fac26-4f0a-4df0-abae-b5af9d8dfbd4","year":2019},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.447051Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:780d51124374285d8234bc7ba628bdca6bc2deb0a5d2905e1206dbee78d039e6","observation_id":"54313299-44bc-4c9e-ba05-01afdf70c610","resolution":{"observed_at":"2026-08-16T11:35:50.293658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.271465Z","title":"A game theoretic approach to controller design for hybrid systems","venue":null,"work_id":"951fe303-4d77-4f4b-8704-a6cf7d11e39a","year":2000},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.452061Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ea5597bd42176820f56e81449f8c2dd9759258fb553a5238722915e60a1a3db8","observation_id":"1522d750-8cc9-46c0-92a8-36bb1816632f","resolution":{"observed_at":"2026-08-16T11:35:50.276454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.255083Z","title":"Decentralized multi-agent planning using model predictive control and time-aware safe corridors","venue":null,"work_id":"d1548c7d-cf2a-4433-a936-f61b0e15fc50","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.456929Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b585af373311dd8d0691153ab0d1fffd1e5ac091f940d73475990d3fa1b86b55","observation_id":"fcfdc6fa-dcc9-44db-82af-7ef417761499","resolution":{"observed_at":"2026-08-16T11:35:50.260275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.236685Z","title":"Initial guess generation for aircraft landing trajec- tory optimization","venue":null,"work_id":"10ffb2c3-f88f-4079-89d5-c98e1b131f6a","year":2011},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.461859Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:e0635626c6eab416543ed302aa9a8e4b72ffa1dde4ee01942bfee139a83a1844","observation_id":"f2d69c81-cba1-4274-9b0a-19aa5399a1d1","resolution":{"observed_at":"2026-08-16T11:35:50.241930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.01062","last_updated":"2021-10-04T01:36:59Z","snapshot_observed_at":"2026-08-17T13:38:20.451855Z","submitted_at":"2020-08-03T17:52:09Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.01062","snapshot_observed_at":"2026-08-16T11:35:49.466812Z","title":"Qplex: Duplex dueling multi-agent q- learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.466812Z"},"links":{"cited_paper":"/paper/2008.01062","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:83ec99517c7816753e7836d47ceb2c22d6c350e08d2bfaba0fd23fa7f9f2a626","observation_id":"85c5ed1a-92ab-48d1-ad9b-02b126e0355f","resolution":{"observed_at":"2026-08-16T11:35:49.466812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.220131Z","title":"A synthesis approach of distributed model predictive control for homogeneous multi-agent system with collision avoidance","venue":null,"work_id":"3beeb956-d082-4c02-adc8-49a96821566d","year":2014},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.472565Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4d7769202564965d0d34537df261e75bf6f6eee4997ef0356106c3ac1a826da7","observation_id":"587b983f-2f82-460d-b4f8-21478fb37347","resolution":{"observed_at":"2026-08-16T11:35:50.225310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.478723Z","title":"Multi-agent deep reinforcement learning for urban traffic light control in vehicular networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.478723Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:bfdb4ec96613e303cc3a38176e3ff836d2c3855888d7a5f2b4c24fced9657872","observation_id":"04916c6e-b7d6-41bc-be07-e2a7093bf891","resolution":{"observed_at":"2026-08-16T11:35:49.478723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06281","last_updated":"2023-04-13T06:08:10Z","snapshot_observed_at":"2026-08-18T00:54:58.403881Z","submitted_at":"2023-04-13T06:08:10Z","title":"Model-based Dynamic Shielding for Safe and Efficient Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06281","snapshot_observed_at":"2026-08-16T11:35:49.483573Z","title":"Model-based dynamic shielding for safe and efficient multi-agent re- inforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.483573Z"},"links":{"cited_paper":"/paper/2304.06281","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0ba8e4d9c4ceed77e28e6417de569bbd8210aa1921a25ad059f558130b39e2ad","observation_id":"abafd294-d515-4529-a413-1c0fd57fab81","resolution":{"observed_at":"2026-08-16T11:35:49.483573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.190505Z","title":"Crpo: A new approach for safe reinforcement learning with convergence guarantee","venue":null,"work_id":"ea6aca92-f147-4e36-aecd-4c4790949b1f","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.488687Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:5772df0a3e63208907e4dea5674477f1cf1a5928e51a36bf64271bf4c70fb417","observation_id":"1f6914fa-a1f2-4d92-8206-66da2e5e14e4","resolution":{"observed_at":"2026-08-16T11:35:50.196643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-08-18T16:24:37.512043Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-16T11:35:49.493384Z","title":"Qat- ten: A general framework for cooperative multiagent re- inforcement learning","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.493384Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:70931756fb7cbdc9ff594227a686ad9ac31a0f1d0bd7bec102be573f5beedfa4","observation_id":"71321466-c55e-4511-a348-002b28d81941","resolution":{"observed_at":"2026-08-16T11:35:49.493384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.172630Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":"3b7c621b-c02b-406c-90f0-408a0abc0a47","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.499001Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:aeadac74d247c414278a72217cf9d7819ccd61b4d2843fcd848d7151d7c60d18","observation_id":"69237a14-51b7-4de9-a903-c724df5cc2e1","resolution":{"observed_at":"2026-08-16T11:35:50.178088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.155717Z","title":"Reachability constrained reinforcement learning","venue":null,"work_id":"06fa3397-a8de-4ec8-bc81-a38d9c7f9f2f","year":2022},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.504513Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:49ca9a47f5560147fae7e129de82fe4c3fe0f2200c07fa191f52304af38fb7b8","observation_id":"9095540a-b7ea-4b7b-9411-59b023a5f2e6","resolution":{"observed_at":"2026-08-16T11:35:50.161635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.137945Z","title":"Safe reinforcement learning using robust mpc","venue":null,"work_id":"989964eb-825a-4928-b675-bdafc927c3fa","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.509472Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:4f8809bc3683539504050ea09aa63da5b2fbc416fb174abe9784f8049923a1ad","observation_id":"b2c0f567-268e-4b73-9e38-2d1f76ccf2b8","resolution":{"observed_at":"2026-08-16T11:35:50.143568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.118041Z","title":"Fully decentralized multi-agent re- inforcement learning with networked agents","venue":null,"work_id":"52c57e29-1cf1-4453-a1f8-e50523f8663e","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.514827Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7c73e7f743b7e75b81b5bae55460d854eea87b0550dfa264eed8a12bf485c941","observation_id":"73060d35-0d38-480d-bfe0-fee0857b7def","resolution":{"observed_at":"2026-08-16T11:35:50.124360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.099771Z","title":"Multi- agent reinforcement learning: A selective overview of theories and algorithms","venue":null,"work_id":"695bb1ac-438a-43b0-8b21-82071eaed986","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.520678Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:53850009188bdeac0acbb1c7a9ebcf45349dc18a0ac63606e13cceb6b23073cd","observation_id":"ffe68379-54e4-4d0b-a739-3bd8773eda9e","resolution":{"observed_at":"2026-08-16T11:35:50.105282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.083661Z","title":"Neu- ral graph control barrier functions guided distributed collision-avoidance multi-agent control","venue":null,"work_id":"97e98829-bc88-488f-8075-bfc268efaae0","year":2023},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.525301Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b5361dc08b7fa7dd701e24bfb26393883d72f3f20346742ce4966d4e68e5673f","observation_id":"6eb47d82-ce9b-450e-a34e-ae2cb5161338","resolution":{"observed_at":"2026-08-16T11:35:50.088952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.067182Z","title":"Discrete GCBF proximal policy optimization for multi-agent safe optimal control","venue":null,"work_id":"4d7fe1a1-52a2-47cd-8120-ad221db6fd9f","year":2025},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.530170Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:71870d08e4e2b423959d9785f6aac3543e0d9bb3828e6b4251fbc46bf421aa4b","observation_id":"cc55ae64-209c-4442-a094-ae8e0610b2d1","resolution":{"observed_at":"2026-08-16T11:35:50.072861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.050612Z","title":"GCBF+: A neural graph control barrier function framework for distributed safe multiagent control","venue":null,"work_id":"438f835b-d0d8-4878-97dc-b95100c0982e","year":2025},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.534940Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:b561eb6e82646ea6bc3d8a4753d59788c74544f832d05e3382ee1ccdb4db10e6","observation_id":"56eb93fb-3c0f-401d-b7cd-674dd7a7498e","resolution":{"observed_at":"2026-08-16T11:35:50.055969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12639","last_updated":"2019-12-28T03:03:04Z","snapshot_observed_at":"2026-08-10T20:31:22.283484Z","submitted_at":"2019-10-25T01:26:04Z","title":"MAMPS: Safe Multi-Agent Reinforcement Learning via Model Predictive Shielding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12639","snapshot_observed_at":"2026-08-16T11:35:49.539360Z","title":"Mamps: Safe multi-agent reinforcement learning via model pre- dictive shielding","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.539360Z"},"links":{"cited_paper":"/paper/1910.12639","citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:d6c0e293ec41cdfc491a73fb18b1a47d544e6f9f26def92ca64db9bd079a5036","observation_id":"89e57848-5be3-4969-8f1a-b94fca74a625","resolution":{"observed_at":"2026-08-16T11:35:49.539360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.034944Z","title":"Model-free safe control for zero-violation reinforcement learning","venue":null,"work_id":"55c21faf-4d6b-4068-b2bf-0d39e5551e2e","year":2021},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.544295Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:1a47fc5ac9a0618dbca519460a796d440264c3b508bb94aaf7e0fd1ad6fc2c45","observation_id":"cc1d6b07-680b-41d2-9377-4f86753bcc21","resolution":{"observed_at":"2026-08-16T11:35:50.040156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.018455Z","title":"Multi-agent first order con- strained optimization in policy space","venue":null,"work_id":"5b358919-639a-4349-8618-e096a7884950","year":2024},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.549368Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:6e5868956c022c77160187920aedd859b68772bf538331b322d54224203c1fb7","observation_id":"02e63a0a-c108-48df-95a8-786b32f80c81","resolution":{"observed_at":"2026-08-16T11:35:50.023762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:50.001794Z","title":"Fast, on-line collision avoidance for dynamic vehicles using buffered voronoi cells","venue":null,"work_id":"67735304-1d57-45d3-ad8a-09b8df94f1a0","year":2017},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.555561Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:08591fbec6f6f9678daa0dff275a3443df5bb8dfe389859aec298810c16a149e","observation_id":"c23fb004-13ae-4b79-bebd-59a7e5ab4f6f","resolution":{"observed_at":"2026-08-16T11:35:50.006851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.985143Z","title":"Trajectory optimization for nonlinear multi-agent systems using decentralized learning model predictive control","venue":null,"work_id":"7e021acc-0dab-4332-9885-a32fa231a013","year":2020},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.560635Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:7463d8a887f87e0d52fb2c075881ffe8d3cecc2a29a5c662209571bc4d93c36e","observation_id":"d8b0142c-0fc5-41ba-b1f1-3b1efdd930f5","resolution":{"observed_at":"2026-08-16T11:35:49.990352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.968016Z","title":"In other words, for a given z0, the value at the kth timestep is only a function of zk and xk instead of the z0 and the entire trajectory up to the kth timestep","venue":null,"work_id":"7a813b15-7166-4912-98dc-5ff87ac5d7e3","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.565966Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:31b6868ace9dd62f1253f853ef6e54339a3d45e29a01c62d6184196c964dc38a","observation_id":"26b1b56b-96f7-4307-bc1d-b75711f7a03f","resolution":{"observed_at":"2026-08-16T11:35:49.972993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.950259Z","title":null,"venue":null,"work_id":"7f2fa280-0004-49d4-858c-9f19e4df252a","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.570731Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:0487b48f29c529a5f8b41bdcf2baf4bc15274ee728828b3cb8a212d60904f6c0","observation_id":"f0cdaa1e-0e66-4000-aae9-24dc084b845f","resolution":{"observed_at":"2026-08-16T11:35:49.955745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.933675Z","title":null,"venue":null,"work_id":"8fd1f0e5-4a32-43fd-aff7-9ebe6369387f","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.575826Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:54cc7a661757042b4b0391e06d03a72f88cf8fc6daba2069f015a6454b764142","observation_id":"6cffaff4-cbbf-4eac-8f7f-8c27fe1a09b2","resolution":{"observed_at":"2026-08-16T11:35:49.938382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.917831Z","title":null,"venue":null,"work_id":"027631a2-8526-41d5-8b23-fa3357dd5cdc","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.580801Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:27b99f4d2c2a04ea71d858aafa883244124f21eeb82adda81135c5e61ef88cec","observation_id":"53d0bdd6-665c-4045-a16d-ea6f6b03ab4d","resolution":{"observed_at":"2026-08-16T11:35:49.922510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.900945Z","title":"APPENDIX D ALGORITHM PSEUDOCODE We describe the centralized training process of Def-MARL in Algorithm 1 and the distributed execution process in Algorithm 2","venue":null,"work_id":"32797875-2f22-42a1-a246-cadc7f13d961","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.585636Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:01431da64d4e79b7dceab57eebe0fefa0aeff79390e153d47acee2aff20fc521","observation_id":"be1d4854-de22-48a7-876d-7e1571c4931d","resolution":{"observed_at":"2026-08-16T11:35:49.907043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.882680Z","title":"E⊆{ (i,j )|i∈V a,j ∈V} is the set of edges, denoting the information flow from a sender node j to a receiver agent i","venue":null,"work_id":"7f6105ab-fded-4fcd-ac0c-1fc6c968fa53","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.590785Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:150204133847eb70df5b765d1a213eef3fafd0193e7db830fe77381a8cc733c6","observation_id":"99cdc52b-244d-4645-aa18-6dae73dd4be0","resolution":{"observed_at":"2026-08-16T11:35:49.889638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:35:49.864235Z","title":null,"venue":null,"work_id":"4a13c137-9418-433a-888d-5bd101df6961","year":null},"citing_paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T11:35:49.596258Z"},"links":{"citing_paper":"/paper/2504.15425"},"observation_digest":"sha256:ec54b45d3daff5c5ac817153f8fae2dce4ea6159adcf8c71c29d5fd75632fa45","observation_id":"2884d2e1-7170-4d80-beb3-d044cd74f8c9","resolution":{"observed_at":"2026-08-16T11:35:49.870781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.15425","last_updated":"2025-04-21T20:34:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T22:45:07.397065Z","submitted_at":"2025-04-21T20:34:55Z","title":"Solving Multi-Agent Safe Optimal Control with Distributed Epigraph Form MARL"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 1 inbound Pith citation observation for arXiv:2504.15425."}