{"as_of":"2026-08-11T01:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08455560a834a08bc78769659f0bd95b2ec6500234433a58b467c9277d564195","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:43.089424Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14209/citation-record","integrity":"/paper/2505.14209/integrity","json":"/paper/2505.14209/citation-record.json","paper":"/paper/2505.14209"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:51.381516Z","title":"A review of multi-agent perimeter defense games,","venue":null,"work_id":"65f44abc-59ab-4254-a5c4-e5f7c4b22a18","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.089250Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c7b884d9467260a7f5ef58898a4a39ced77745005549bf36a9e6724a8e1409ef","observation_id":"65c8b065-a85e-47ef-b361-1eab9e2c38ec","resolution":{"observed_at":"2026-08-07T15:42:51.485434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:51.183201Z","title":"Local-game decomposition for multiplayer perimeter-defense problem,","venue":null,"work_id":"29e295cc-e465-43cd-b6d9-4e5593dfb07a","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.153700Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:19a4b6818cf1a1dbbbac2fbb356158935b91971856d774caefa8ee9a08b44f68","observation_id":"c4f3cc1e-94f7-441c-97bc-b7f3f4597187","resolution":{"observed_at":"2026-08-07T15:42:51.248454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.990358Z","title":"Modeling of target tracking system for homing missiles and air defense systems,","venue":null,"work_id":"cde00125-fd5d-45ec-9489-3f1009898469","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.260792Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:1476f7bb72d8cb4e79ed48ff137d49f97afecff1b9bbad1f3baf31e3e8d2803e","observation_id":"fa26c9d4-ef36-4ba6-ba65-b9fb0be63621","resolution":{"observed_at":"2026-08-07T15:42:51.077899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.741957Z","title":"Simulation of intelligent unmanned aerial vehicle (UA V) for military surveillance,","venue":null,"work_id":"f98e9486-42c1-4501-989d-98ef0abbdc75","year":2013},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.370065Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2bd34d5f30737a87985754c4e546bb825f3713611093c97489e58dbb2d045ecd","observation_id":"c936c982-f38b-41d7-9c21-454a17f37d97","resolution":{"observed_at":"2026-08-07T15:42:50.873793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.620431Z","title":"A hierarchical deep reinforcement learning framework for 6-DOF UCA V air-to-air combat,","venue":null,"work_id":"0aff6d09-9221-4f1a-91f9-c64b2db0db1d","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.456607Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:c8b1391afd35bdb6de54b871e263d0efdca530638c384670b294fa7c0ec0146e","observation_id":"5e3fc813-6565-4816-985c-6b53e6e1b204","resolution":{"observed_at":"2026-08-07T15:42:50.695571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.446642Z","title":null,"venue":null,"work_id":"7cd5651d-0273-4a42-b51c-e3ae2318e076","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.535022Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2c25ec5a7b4440c72345c615113051f162fcbae97b14957ab29061408eee3647","observation_id":"379d3435-9bb1-42f4-a5da-fcd0ed85f181","resolution":{"observed_at":"2026-08-07T15:42:50.474913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.229347Z","title":"Competitive perimeter defense on a line,","venue":null,"work_id":"bebf7e8d-41a8-4ace-89a5-95cfd6f12daf","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.658738Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:b6f76eb0d3dbd199e4d5630eb5ff7091c0a38fe9ba66f4663076a288c8828a04","observation_id":"27fbd88d-1b71-4f12-a266-c61365f76bb3","resolution":{"observed_at":"2026-08-07T15:42:50.313945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:50.056041Z","title":"Team composition for perimeter defense with patrollers and defenders,","venue":null,"work_id":"b48cf50d-33e1-456c-9c6d-88fb085dd83c","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.757099Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:4e40fee04b7c4d4f8a39f1aeff9e063bba2d3bbd4f40b88da94c87480e8d2a34","observation_id":"fcc9c6d1-6b0c-492b-b6a4-509d87dc53d1","resolution":{"observed_at":"2026-08-07T15:42:50.185536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.780108Z","title":"Cooperative team strategies for multi-player perimeter-defense games,","venue":null,"work_id":"5dd9cccc-d36a-4070-8286-915b508edfe1","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.828945Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:80662e0f5e6daa5275a5da85b440e718856d48b02ba5ce04dc7ac1f7a4d583e4","observation_id":"324a1788-5e9d-4905-910d-5038cbf905d9","resolution":{"observed_at":"2026-08-07T15:42:49.902523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03989","last_updated":"2021-05-01T04:20:32Z","snapshot_observed_at":"2026-08-06T16:35:45.702720Z","submitted_at":"2019-09-09T16:58:56Z","title":"Perimeter-defense Game on Arbitrary Convex Shapes","version":3},"cited_work":{"arxiv_id":"1909.03989","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.03989","snapshot_observed_at":"2026-08-07T15:42:43.888733Z","title":"Perimeter-defense Game on Arbitrary Convex Shapes","venue":"eess.SY","work_id":"c9b9c27b-0e0c-434b-89be-98d06c5b3297","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.935733Z"},"links":{"cited_paper":"/paper/1909.03989","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:9939ca55f364306548676837be2337a0a4d927ade1456d7b78465a5f524cb884","observation_id":"56ba129d-8a6c-4bf3-acaf-aed8e4d3be83","resolution":{"observed_at":"2026-08-07T15:42:43.929369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.666589Z","title":"Multivehicle perimeter defense in conical environments,","venue":null,"work_id":"2ae7d691-fb76-4aed-b02d-e4b1997dede0","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:38.996933Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:b2444367a6ec719e544bdada14d3ff970dafed0130bda66d7d57c76f3dec0f44","observation_id":"05b0481a-b4a2-4c99-949c-d298fa63ecf3","resolution":{"observed_at":"2026-08-07T15:42:49.718911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.465353Z","title":"Perimeter-defense game between aerial defender and ground intruder,","venue":null,"work_id":"6644f83c-716f-48b3-8606-1a2ff110f131","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.085886Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:9432e4fbcbfb78d44a62f55bd0b913fb0bebf061602ff4534a4e56703fa33d87","observation_id":"17863a73-ca1d-4a16-b2a8-60180e8cb232","resolution":{"observed_at":"2026-08-07T15:42:49.560139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.308792Z","title":"Defending a perimeter from a ground intruder using an aerial defender: Theory and practice,","venue":null,"work_id":"3d55758d-7ede-4ff4-8d0f-441f61bb7abb","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.211142Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:fc5ee42e50d16091fc9308ee51187af5daf013213b3ed9975a4e74aaa7362202","observation_id":"4ae7e59d-1413-43d9-99d5-b5c0d91c514e","resolution":{"observed_at":"2026-08-07T15:42:49.390587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01757","last_updated":"2022-09-24T22:48:51Z","snapshot_observed_at":"2026-08-05T07:55:57.101722Z","submitted_at":"2022-09-24T22:48:51Z","title":"Learning Decentralized Strategies for a Perimeter Defense Game with Graph Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01757","snapshot_observed_at":"2026-08-07T15:42:39.298718Z","title":"Learning decentralized strategies for a perimeter defense game with graph neural networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.298718Z"},"links":{"cited_paper":"/paper/2211.01757","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3638cf026d88d78871364e212b3ea8bb958a5bd1c75c3e359e37787ef23d3e15","observation_id":"b018a4b0-ec6a-4571-a27e-469d6fa13937","resolution":{"observed_at":"2026-08-07T15:42:39.298718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12136","last_updated":"2022-09-25T03:41:45Z","snapshot_observed_at":"2026-08-06T05:50:26.092516Z","submitted_at":"2022-09-25T03:41:45Z","title":"Vision-based Perimeter Defense via Multiview Pose Estimation","version":1},"cited_work":{"arxiv_id":"2209.12136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.12136","snapshot_observed_at":"2026-08-07T15:42:43.736564Z","title":"Vision-based Perimeter Defense via Multiview Pose Estimation","venue":"cs.CV","work_id":"6d13b889-5b66-41d2-9e4d-0386bdd4dbef","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.388461Z"},"links":{"cited_paper":"/paper/2209.12136","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:59a67c464c139f4e3f823075dd0f0cbae32d19316d590ad1c56c83c5e969008d","observation_id":"312c2a04-06eb-41d2-893f-e1f11cfbf1c5","resolution":{"observed_at":"2026-08-07T15:42:43.788711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:49.147947Z","title":"The role of heterogeneity in autonomous perimeter defense problems,","venue":null,"work_id":"36eeb4bd-9753-4227-9b8c-91b1111783c6","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.473745Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:2f3b3961ce20b2e8f443b50e821be47c14fcc59d5fd368279aecd5c1665fd673","observation_id":"a8d80f7f-51d0-40be-a679-11380716a7e4","resolution":{"observed_at":"2026-08-07T15:42:49.225002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.963287Z","title":"Intercept angle missile guidance under time vary- ing acceleration bounds,","venue":null,"work_id":"ff402db7-8a99-4ed3-afc0-8b8cfb2ab102","year":2013},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.577566Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f4aa28cbb410439b44e1ef473aa2138527d06ce3e30af4449dd197cd1ece1914","observation_id":"58c816ab-d90a-473e-b3fd-b6b1b53401e5","resolution":{"observed_at":"2026-08-07T15:42:49.054132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.748757Z","title":"The effects of different wing configurations on missile aerodynamics,","venue":null,"work_id":"9e8ea0bd-4076-432c-adab-1a8b303aa5d9","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.677375Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:1dcb92d3e73dfb2e1b968100fab833c9428df29036a010e6eee2bbcf5fc97da8","observation_id":"256f5199-5ffc-4291-854c-a9e0c8da7102","resolution":{"observed_at":"2026-08-07T15:42:48.818595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.596876Z","title":"Dynamic Modeling, Guidance, and Control of Missiles,","venue":null,"work_id":"9024d596-8b58-4d45-b65b-db82eee39ef7","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.769059Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:7e8ca3a5de1480a5b9594b99af6fb406fac62fb5e9eb34deac75bb64f12957ab","observation_id":"7e93d0f3-3bc3-4c03-9456-843af168c59d","resolution":{"observed_at":"2026-08-07T15:42:48.674741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.335876Z","title":"Nonlinear Autopilot for Improving Guidance Performance of Dual-controlled Missiles With Lateral Thrust Regulation,","venue":null,"work_id":"d396ea10-5fb9-4cf6-8f6a-d9de2327ad19","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.858799Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:889eed63bef2c9dc01681ad8356f020371529ddba5d30bf96d0d156afe6465d3","observation_id":"8311fe39-57fa-4673-9453-f8711b8e3172","resolution":{"observed_at":"2026-08-07T15:42:48.423402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:48.099383Z","title":"Wind compensation framework for unpowered aircraft using online waypoint correction,","venue":null,"work_id":"649e3271-7a3e-4506-ab58-96f6025f6341","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:39.969334Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:22aa1be9bbd70ff47bfd017f2b2efe60bb0ff57ca6978a32a906aa07f63f314c","observation_id":"a50164ba-0f11-41e0-9a38-227bd6b50a5f","resolution":{"observed_at":"2026-08-07T15:42:48.215889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.910640Z","title":"Attitude control in ascent phase of missile considering actuator non-linearity and wind disturbance,","venue":null,"work_id":"0e186f91-43ee-485c-84ba-bd3bb812f2dc","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.033268Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:cf73b4e419fc34fc0608932bf663838a5f0c83a37e9b2c508b0bdbd17c634516","observation_id":"520d503d-b98b-489c-a18a-c3f8e79e196f","resolution":{"observed_at":"2026-08-07T15:42:47.976040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.692807Z","title":"Safe multi-agent reinforcement learning for multi-robot control,","venue":null,"work_id":"d972a391-7bd7-4464-aeb2-9236da55ef38","year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.128968Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:34b3de4212284166950356365166463724c5d9fc47bc6944e321e854dd6a1ae2","observation_id":"29b6f66e-9ec6-456a-b64e-96871d3824b5","resolution":{"observed_at":"2026-08-07T15:42:47.794218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.358308Z","title":"Deep reinforcement learning for autonomous driving: A survey,","venue":null,"work_id":"e94d0065-6242-40a7-8657-7171738563b0","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.188906Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:b9d35ef87028ef36ae726f77c341c7a8f3836b83d6270cf83debe8937f277948","observation_id":"6135d2c2-d6fe-40b0-97d1-dfeba5c7e7ca","resolution":{"observed_at":"2026-08-07T15:42:47.508583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.197436Z","title":"Cooperative control for multi-player pursuit-evasion games with reinforcement learning,","venue":null,"work_id":"941d4d16-b785-4da8-b12a-6177a4d6e0eb","year":2020},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.246739Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3005732e4cef393642db7fd26fbae2574c81c25151c31df38a932251ba8aa296","observation_id":"10c61f30-828e-42a7-8910-6485512d4f5a","resolution":{"observed_at":"2026-08-07T15:42:47.272327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:47.095998Z","title":"An approach to multi-agent pursuit evasion games using reinforcement learning,","venue":null,"work_id":"3885b0ec-2285-4b6e-839c-9746f0122ffe","year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.348726Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ea92f1c37a5eee03a6615e2a25abfd87806dd1e305bf8f5340a199c5d1dc3629","observation_id":"e67381ad-a566-489a-847b-f2b864d3b10c","resolution":{"observed_at":"2026-08-07T15:42:47.146654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.918662Z","title":"Game of drones: Multi-UA V pursuit-evasion game with online motion planning by deep reinforcement learning,","venue":null,"work_id":"1d8c440b-6409-481a-be2d-4eed65441c2d","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.434474Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:7563e1d121b46ed17ba2d96f30e5c74f6bb96e8739972ebe1aa3e50bb4a4bbcc","observation_id":"a5364b30-a2ac-4243-a5b8-9ac7ebc4ec71","resolution":{"observed_at":"2026-08-07T15:42:47.013373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.732835Z","title":"Maximum Entropy Heterogeneous-Agent Reinforcement Learning,","venue":null,"work_id":"b5e0c4f0-fa20-40d0-a698-105ddd752051","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.535742Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f8615ae7e33d5f318029a92b57c631e7dcefc341a4494b1e7654b83467258d4a","observation_id":"710c10ea-224c-4660-b95e-4577a399ed4c","resolution":{"observed_at":"2026-08-07T15:42:46.821175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.553132Z","title":"Heterogeneous-Agent Reinforcement Learning,","venue":null,"work_id":"f511872b-34be-496e-971d-fbfa7bf0bd36","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.657830Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ab16362187631cf8da58a66f30982cab53378bf23980447ebc6a743ff09fcca6","observation_id":"7547ce98-5989-403d-b972-0fe3dd10ee7d","resolution":{"observed_at":"2026-08-07T15:42:46.657243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.390497Z","title":"Mean field multi-agent reinforcement learning,","venue":null,"work_id":"202f11ba-ca32-4cd4-8cee-e89286ea263c","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.759302Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:d2d189b7bba0e90d2059d8c19c03b80b6f41fa7ae0d6c9614ee7e14852bc64c1","observation_id":"c61f88cb-45c9-4b7e-aa09-88fb133624ab","resolution":{"observed_at":"2026-08-07T15:42:46.461921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:46.224588Z","title":"Age of information minimization using multi-agent UA Vs based on AI-enhanced mean field resource allocation,","venue":null,"work_id":"ec408d6b-983f-4618-a3bb-4264556e2cde","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.864615Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:0afaf523c51a4e6d34b2a93ec8bd865d08faac0819aaa4be6077124fc1a38999","observation_id":"12a531f5-9329-45ee-b401-99861dc44209","resolution":{"observed_at":"2026-08-07T15:42:46.284738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.996189Z","title":"Joint Resource Allocation for V2X Communications With Multi-Type Mean-Field Reinforcement Learning,","venue":null,"work_id":"d78d2bc0-7589-4194-87ce-79e4c6763956","year":2024},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.970120Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8f658db3428aebc1a6b3f3729b3fdf5ee2de6d3a2bf9320d951e146444b8305e","observation_id":"bdce975b-b2a2-4c57-a50b-99b896aae4e9","resolution":{"observed_at":"2026-08-07T15:42:46.114954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30082","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.559354Z","title":"Mean Field Deep Reinforcement Learning for Fair and Efficient UA V Control,","venue":null,"work_id":"0c2fc8c6-cf4b-4f1a-80d2-c2346790b818","year":2021},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.077375Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:bb73048064182dba9532c286e5dd871ff53fa34207b53ccadf9d36b2304f8ed7","observation_id":"0afa7f07-8595-4382-8b48-767c432eff80","resolution":{"observed_at":"2026-08-07T15:42:43.616797Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02513","last_updated":"2022-06-21T08:40:51Z","snapshot_observed_at":"2026-08-08T04:52:49.293651Z","submitted_at":"2020-02-06T20:58:58Z","title":"Multi Type Mean Field Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02513","snapshot_observed_at":"2026-08-07T15:42:41.184986Z","title":"Multi type mean field reinforcement learning,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.184986Z"},"links":{"cited_paper":"/paper/2002.02513","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:1ac8ffa81f22b7d50100a58515573fe49faf1f71c56c72203c6f94a4fd9e4c42","observation_id":"dee4f7b5-5477-482f-a1f8-33c7f32a061e","resolution":{"observed_at":"2026-08-07T15:42:41.184986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.761102Z","title":"Hierarchical mean-field deep reinforcement learning for large- scale multiagent systems,","venue":null,"work_id":"10eb66ab-4a20-4210-875b-9ccfaad936b6","year":null},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.261386Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3b0d6d32b15289597a46b31b02d691ea07ae6e3bb552e1e524c95c76e3081211","observation_id":"38bc597a-1abb-4b0f-a0f6-ced8a82370af","resolution":{"observed_at":"2026-08-07T15:42:45.922723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.545524Z","title":"Weighted mean-field multi-agent reinforcement learning via reward attribution decomposition,","venue":null,"work_id":"8314e79b-53f3-4f68-9d8e-39696675bdfb","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.382634Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:40a234ed6e8f2c5ba5631965f94631b913cba243f0c7cb44172e74cdafa7f097","observation_id":"6f150726-7e75-4fc8-a18b-420724056de4","resolution":{"observed_at":"2026-08-07T15:42:45.672117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.337688Z","title":"Attention Is All You Need,","venue":null,"work_id":"d1a7a9da-86ca-473f-b982-0ec5c4960266","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.486585Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:7c7562c30d596eb2948e61c562b0ef66452fabd069e86312b87b087de9b7ada9","observation_id":"036df322-0de1-497a-bcae-144972e55f63","resolution":{"observed_at":"2026-08-07T15:42:45.444065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14226","last_updated":"2024-05-01T13:00:39Z","snapshot_observed_at":"2026-07-06T13:46:52.990082Z","submitted_at":"2022-08-27T09:38:56Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14226","snapshot_observed_at":"2026-08-07T15:42:41.674213Z","title":"Unsupervised representation learning in deep rein- forcement learning: A review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.674213Z"},"links":{"cited_paper":"/paper/2208.14226","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:f63d6ed5dd752ad186c1964db32d81c2e0e1d91ed50b0e361f7a9385d646f5be","observation_id":"5e413bd5-7749-47ff-be18-b0a785b446e2","resolution":{"observed_at":"2026-08-07T15:42:41.674213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:45.170572Z","title":"Fraccaro, S","venue":null,"work_id":"b58f2e0f-516c-4326-b22d-92eda4fe15dd","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.807648Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:4580cd58201d51bb795f501b623fcb9b07b11a5b7328f1399382de06cdd29b86","observation_id":"1207fbde-401b-4161-b3c6-8aa73c267d56","resolution":{"observed_at":"2026-08-07T15:42:45.225758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.999417Z","title":"Ha and J","venue":null,"work_id":"4c6e8048-c984-43dd-84d9-f34c9a11e640","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.877045Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ff160a16d2f3565e083d0bc648dae39b7726fa01f06e14f209b6e8b2166241b7","observation_id":"7f3d9612-0999-4416-b083-1f582aa50176","resolution":{"observed_at":"2026-08-07T15:42:45.046871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-07T15:42:41.944567Z","title":"Ha and J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:41.944567Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:8a28dbaeb377f900b564d5a0e603dbe1aec7ecb3dc9ef45baed8c77adebe9db5","observation_id":"ae5c331c-da92-4ead-86a5-b41221d49ccd","resolution":{"observed_at":"2026-08-07T15:42:41.944567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11963","last_updated":"2020-02-27T08:29:10Z","snapshot_observed_at":"2026-08-08T06:19:38.136041Z","submitted_at":"2020-02-27T08:29:10Z","title":"Plannable Approximations to MDP Homomorphisms: Equivariance under Actions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.11963","snapshot_observed_at":"2026-08-07T15:42:42.026878Z","title":"Van der Pol, T","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.026878Z"},"links":{"cited_paper":"/paper/2002.11963","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:4f77b4b6fc8a5aa34a00dd4335617f03c4b6aa2b6f603ae6cf156428a0478481","observation_id":"9e21d576-90cf-466f-965b-7036f8dde1f2","resolution":{"observed_at":"2026-08-07T15:42:42.026878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.07679","last_updated":"2016-04-04T11:27:36Z","snapshot_observed_at":"2026-08-03T08:37:56.722087Z","submitted_at":"2015-12-24T01:31:40Z","title":"Deep Reinforcement Learning in Large Discrete Action Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.07679","snapshot_observed_at":"2026-08-07T15:42:42.109923Z","title":"Dulac-Arnold et al.,Deep reinforcement learning in large discrete action spaces","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.109923Z"},"links":{"cited_paper":"/paper/1512.07679","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:532ef3b7192c78be6edb26dad89e69231de80d4cea1296a6fbf65970e87e9e50","observation_id":"b26677a0-cb7a-4c76-9349-7035b64c0361","resolution":{"observed_at":"2026-08-07T15:42:42.109923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02006","last_updated":"2023-06-03T05:32:19Z","snapshot_observed_at":"2026-08-10T15:15:24.250752Z","submitted_at":"2023-06-03T05:32:19Z","title":"MA2CL:Masked Attentive Contrastive Learning for Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02006","snapshot_observed_at":"2026-08-07T15:42:42.213768Z","title":"MA2CL: Masked Attentive Contrastive Learning for Multi-Agent Reinforcement Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.213768Z"},"links":{"cited_paper":"/paper/2306.02006","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:3d964bce75f76d8b11d631f8b531a71eb4246a4f6bbb34a050262aefe32aeee2","observation_id":"b2926790-48f9-448a-8686-a10be5b23d0c","resolution":{"observed_at":"2026-08-07T15:42:42.213768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.811368Z","title":"Learning action representations for reinforcement learning,","venue":null,"work_id":"84a6c993-6f5b-4938-b7c9-3f068adb21bc","year":2019},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.318289Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ed719c2bda88ac5d4ddff38a695a7319b832c6eaf26fea60357cbbc9a44ccafa","observation_id":"8a638511-1288-41c9-8a87-59ef9655ccc4","resolution":{"observed_at":"2026-08-07T15:42:44.916663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.669961Z","title":"The Hungarian method for the assignment problem,","venue":null,"work_id":"6e389e5c-4f91-47b0-8358-5e60f2a37e8b","year":1955},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.407479Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:aa132c185729c061d4119c2e1e1ef27e58f194200824e4aa33e16f8173dee34c","observation_id":"9ac4c81d-f50c-45c2-aae7-2f93d65379a9","resolution":{"observed_at":"2026-08-07T15:42:44.721298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.27033","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:43.281259Z","title":null,"venue":null,"work_id":"58afa798-6ac4-4563-b994-ff3bd28b7624","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.505143Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:ab508292f88f02465af14873647da2d07a6e92ea482e3e5915c13c143605bd6a","observation_id":"69449878-9d92-4fc5-bf49-784d27c3f492","resolution":{"observed_at":"2026-08-07T15:42:43.341686Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:42.587925Z","title":"Robust estimation of a location parameter,","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.587925Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:25481664d5d9ff484061a240abe975fc2f2586548f02b1c64f075a4a8c45881f","observation_id":"13d15a98-7054-4a45-a24a-ecf168993048","resolution":{"observed_at":"2026-08-07T15:42:42.587925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T15:42:42.682393Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.682393Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:e8f95b14a5bef89c0cf4d118c7db1769c2e1ffc54c4122e0a426b859d582c6ac","observation_id":"c0e6bd86-c020-4fe6-864a-bf25a73feff5","resolution":{"observed_at":"2026-08-07T15:42:42.682393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.521314Z","title":"Addressing function approxima- tion error in actor-critic methods,","venue":null,"work_id":"a3188aaa-1166-4ccc-9638-577f7fd0aaba","year":2018},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.770074Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:a0e470f023e846865ab63d51ee8ff1486b8b0b7e1e1f10502a1520a019a79749","observation_id":"e8720438-3187-4770-8331-15ad22b8bb0f","resolution":{"observed_at":"2026-08-07T15:42:44.590441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.366541Z","title":"Multi-agent actor-critic for mixed cooperative-competitive envi- ronments,","venue":null,"work_id":"86b2118a-235b-450a-80f5-71aac73b846e","year":2017},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.844272Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:61a5f0bdb4fcece23b273cf67e208f0bf632ab0a981506152d637a9a77331897","observation_id":"c203d6cb-65ae-4b5e-9703-e641c0e661e3","resolution":{"observed_at":"2026-08-07T15:42:44.443084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.021785Z","title":"degree at the same institution, under the supervision of Prof","venue":null,"work_id":"15c8444c-edfd-4a1e-afd6-81e5638fa545","year":2022},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:43.089424Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:e764ce6c64ae8603a20299a646da752ad788fdb00373d5b2b0e5863834322f7c","observation_id":"a557bfc1-3d13-4617-948b-42165aa6fef2","resolution":{"observed_at":"2026-08-07T15:42:44.130662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:42:44.191300Z","title":"degree at the same institution, under the supervision of Prof","venue":null,"work_id":"cb6ef03f-38f3-423d-8bf6-dccc71dcafba","year":null},"citing_paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:42.956255Z"},"links":{"citing_paper":"/paper/2505.14209"},"observation_digest":"sha256:d4afdb59ae3568c0272fc9a5e3baf9691650a91f3566ec5f3a8e0716bc96d8ed","observation_id":"0f8e4b14-4df5-4bdc-88f9-7aabac3966c7","resolution":{"observed_at":"2026-08-07T15:42:44.263995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14209","last_updated":"2025-05-20T11:11:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T18:35:10.926856Z","submitted_at":"2025-05-20T11:11:46Z","title":"Embedded Mean Field Reinforcement Learning for Perimeter-defense Game"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":39},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.14209."}