{"as_of":"2026-08-11T02:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:face6d960a9fff3049a33b7a0b71f7f8080a9b99f7cb25add56220200d892b92","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:10:44.818148Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T03:03:29.755428Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T03:05:48.238883Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"cited_work":{"arxiv_id":"2505.19837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-agent re- inforcement learning in cybersecurity: From fundamentals to applications","venue":null,"work_id":"b4d7865a-132c-4f54-9c48-e736ae9a1287","year":2025},"citing_paper":{"arxiv_id":"2510.25939","last_updated":"2026-04-07T09:33:43Z","snapshot_observed_at":"2026-07-06T22:34:23.736456Z","submitted_at":"2025-10-29T20:20:51Z","title":"SoK: Honeypots & LLMs, More Than the Sum of Their Parts?","version":4},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-18T03:03:29.755428Z"},"links":{"cited_paper":"/paper/2505.19837","citing_paper":"/paper/2510.25939"},"observation_digest":"sha256:2b210661344fbaf78cdf833180ec39893298d8621dfa11f1ae1e913c6596b1f9","observation_id":"d96ce6b1-84e4-4bc5-bce4-abc3d1265df8","resolution":{"observed_at":"2026-05-18T03:05:48.240750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19837/citation-record","integrity":"/paper/2505.19837/integrity","json":"/paper/2505.19837/citation-record.json","paper":"/paper/2505.19837"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.899851Z","title":"Muggah and M","venue":null,"work_id":"830137bd-9b85-4452-8991-cb90d0a964f5","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:37.936191Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:740869ec7798ca01c1add020a1af6fb8b93cf0473211e55b19c74a99bbd67110","observation_id":"0c303911-58c4-4837-972d-0be6a8003aab","resolution":{"observed_at":"2026-08-07T14:10:54.981740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.761941Z","title":"Dynamic vs. static cybersecurity: Which approach is more effective?","venue":null,"work_id":"ba49a862-32d9-478f-829e-aded3d199ab2","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.021099Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:4e0ee5e3dc5aa9729dc821cdcea2d1d631c203b76bd7c35a0668d97929c956d1","observation_id":"ecb94ed6-0dee-48e0-ba0c-c4826bdc1c22","resolution":{"observed_at":"2026-08-07T14:10:54.799402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.723889Z","title":"Does traditional security protect against modern threats?","venue":null,"work_id":"7929833b-6128-47bb-9796-24f19505c69a","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.127450Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:68a9a25808aed4a15ddab4abe802f5c40a854c62c404f99f80ca8906664b6725","observation_id":"9d5eac62-7282-4abc-be09-0251f62a03c4","resolution":{"observed_at":"2026-08-07T14:10:54.748066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.675881Z","title":"As the threat landscape changes, traditional cybersecurity approaches need to evolve,","venue":null,"work_id":"05a6861e-eab7-4cdc-8383-d99473aec609","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.246062Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:79d0c5cfc0418a3de2f38751725debd067653c668950b2f32cda6d8dcadb4cc8","observation_id":"fd795b31-ec4f-455b-966c-ea9eb3da1f06","resolution":{"observed_at":"2026-08-07T14:10:54.705345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.627102Z","title":"Cyber grand challenge,","venue":null,"work_id":"3f464f03-369d-4dcc-9f66-2b7549547fea","year":2016},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.356260Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:6e8cec88acffb9b2e288e8ebacab9f6397d99eda7cef6b48a5c7bfda89a2ca7d","observation_id":"26f0676c-6cfa-4811-b79b-bbf7c92bdba1","resolution":{"observed_at":"2026-08-07T14:10:54.638422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.584614Z","title":"The mayhem cyber reasoning system,","venue":null,"work_id":"f31db422-ec17-4bc9-adb7-444d7bbc275f","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.469272Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:bbeeeafdd4ec7640bed76fdf2e561a91e794a99a566801df0e705d5e246edc08","observation_id":"ab79abcb-8462-46e2-842c-016e9cda9290","resolution":{"observed_at":"2026-08-07T14:10:54.598721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.526436Z","title":"Xandra: An autonomous cyber battle system for the cyber grand challenge,","venue":null,"work_id":"42f0bcf6-7a25-4853-8620-4a28b3e2577d","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.574637Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0fcfd385a0f3cd33e8631f599fbb080d6da2540f00acdeafabec78d7467d157c","observation_id":"15c87119-1b65-4326-9ccd-0ee76eb8dff3","resolution":{"observed_at":"2026-08-07T14:10:54.553235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.482908Z","title":"Mechanical phish: Resilient autonomous hacking,","venue":null,"work_id":"a59cf6ca-57f2-4170-aac1-7f4b0d15bdfe","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.644533Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:185830991bc5c74ca8b991144067ef31303063aa87c53ddda1a378649645e7e3","observation_id":"665549e3-209c-43e9-a3c8-57692ed5071f","resolution":{"observed_at":"2026-08-07T14:10:54.496827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.447146Z","title":"The future of Cyber-Autonomy,","venue":null,"work_id":"7d058a74-bdac-46bc-8830-161813076967","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.722447Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:6d6d16ff3bc442094fe7e169de9a121c7e2f05095472f9f7ea8eaa540635eccc","observation_id":"021e2aba-26b7-413c-9431-ab10290dd7f0","resolution":{"observed_at":"2026-08-07T14:10:54.459985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.365188Z","title":"Orientation guide for the security of critical infrastructures,","venue":null,"work_id":"660e9c01-dc5e-4df9-be92-c558e32510d0","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.798934Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2bbdd34f09a34730e3aa05627c0f9252327baf10b04236a8873bf274f0387525","observation_id":"7637e23b-9765-43d9-b90a-b1ed1c112322","resolution":{"observed_at":"2026-08-07T14:10:54.422290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.206162Z","title":"Fuzzing: Chal- lenges and reflections,","venue":null,"work_id":"ede5914c-7c73-4e30-a8b3-9b05afb7f390","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.871919Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:5f3238ddc76d114b7be3406db94ced8f78439a18524283d7a4cf0ee8a9967312","observation_id":"e6a26cc9-ab84-424f-bf94-329b7c973b9b","resolution":{"observed_at":"2026-08-07T14:10:54.287932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30409","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:46.775209Z","title":"Reinforcement learning for iot security: A comprehensive survey,","venue":null,"work_id":"33bd8323-fb4b-4fbc-8abd-b28642b1b095","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.963661Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c42df16941217cf5b6108836650d547d08d670f02c030c8b4bae121727d17d6c","observation_id":"683dbab7-12c2-4618-a5f4-776848d064dc","resolution":{"observed_at":"2026-08-07T14:10:46.912286Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.067177Z","title":"Cyber-security and reinforcement learning — a brief survey,","venue":null,"work_id":"b84bb2b9-53ce-4b82-85f1-b5c5325c9566","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.079039Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:4e3708103b16d6e223290d94a829b89e0120d8f6de9a804165985edad876258c","observation_id":"fe9052e1-3dad-4fb5-a512-1667bbffd429","resolution":{"observed_at":"2026-08-07T14:10:54.127208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.936517Z","title":"A review of machine learning-based zero-day attack detection: Challenges and future directions,","venue":null,"work_id":"56ac582b-8c0d-4dfc-9426-022b82fe56f7","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.185882Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a078fec46fce9ab4b1d593f2a3187c325ba83c688d6a71984b074787cf979858","observation_id":"61bcb419-e692-4138-a1e5-6d3714a51825","resolution":{"observed_at":"2026-08-07T14:10:53.980463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-30719-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Lecture notes in computer science","work_id":"78fd1c6b-7bef-4136-ac51-ff696c94ab6f","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.279234Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:35a33023a33f5ec11278beddd7227491effcefe510e3e92125a04400b5012a05","observation_id":"dd356410-e452-43de-bcf2-52ce7ef30df5","resolution":{"observed_at":"2026-08-07T14:10:45.115443Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.916177Z","title":"Reinforcement learning applications in cyber security: A review,","venue":null,"work_id":"5ab0a67c-a37e-4f2f-ac63-05dbb4a89bea","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.362945Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a915d4eb216f839effa9e6ece3fc86c9baed277ed8752642c0ebdef978e64c5d","observation_id":"23c1dc98-c0a1-466e-96fe-db0e40f10897","resolution":{"observed_at":"2026-08-07T14:10:53.920461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11052","last_updated":"2023-04-03T20:43:19Z","snapshot_observed_at":"2026-07-06T15:18:26.300068Z","submitted_at":"2023-04-03T20:43:19Z","title":"A Multiagent CyberBattleSim for RL Cyber Operation Agents","version":1},"cited_work":{"arxiv_id":"2304.11052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11052","snapshot_observed_at":"2026-08-07T14:10:46.533577Z","title":"A Multiagent CyberBattleSim for RL Cyber Operation Agents","venue":"cs.CR","work_id":"85104a8d-8d4b-4da5-a78c-9eaf6a054af0","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.455948Z"},"links":{"cited_paper":"/paper/2304.11052","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d099bf05752b74e3992b5fdda6a4fe97c0166504faae07bef4fc04438f06c124","observation_id":"da40eb9e-d858-4e54-b83a-b4d83f951e84","resolution":{"observed_at":"2026-08-07T14:10:46.628329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.705947Z","title":"Automated cyber defence: A review,","venue":null,"work_id":"00959037-f52f-4940-a070-6566d0f6eb6c","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.564908Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e701c65f587a606135cbf934256c900332d598bcc2628e8593b705a81670bdf4","observation_id":"b2acef4d-3bee-4e19-95b2-7fc1fe7d18a8","resolution":{"observed_at":"2026-08-07T14:10:53.856473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07745","last_updated":"2024-09-27T07:26:27Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T16:24:14Z","title":"Deep Reinforcement Learning for Autonomous Cyber Defence: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07745","snapshot_observed_at":"2026-08-07T14:10:39.668054Z","title":"Deep reinforcement learning for autonomous cyber defence: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.668054Z"},"links":{"cited_paper":"/paper/2310.07745","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:8928d1f58ab32665af840c04612696e09f33b330f41180932f0af0728b589547","observation_id":"4d245b6c-588c-43c5-a0a9-3dbff3007d34","resolution":{"observed_at":"2026-08-07T14:10:39.668054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10788","last_updated":"2024-04-12T19:51:45Z","snapshot_observed_at":"2026-08-03T13:28:58.799483Z","submitted_at":"2024-04-12T19:51:45Z","title":"The Path To Autonomous Cyber Defense","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10788","snapshot_observed_at":"2026-08-07T14:10:39.779777Z","title":"The path to autonomous cyber defense,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.779777Z"},"links":{"cited_paper":"/paper/2404.10788","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:7ed8beaed094f31a3ce4c3337c1082953b056392b5b321e7c416072c082c5f4b","observation_id":"98fbf916-86dd-4dfa-8cb7-a4cbd774fa92","resolution":{"observed_at":"2026-08-07T14:10:39.779777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10664","last_updated":"2023-03-22T14:01:19Z","snapshot_observed_at":"2026-07-06T06:30:42.880446Z","submitted_at":"2018-03-28T14:55:53Z","title":"Autonomous Intelligent Cyber-defense Agent (AICA) Reference Architecture. Release 2.0","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10664","snapshot_observed_at":"2026-08-07T14:10:39.888835Z","title":"Autonomous intelligent cyber-defense agent (aica) reference architecture. release 2.0,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.888835Z"},"links":{"cited_paper":"/paper/1803.10664","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2e49d2754570761399cb2de055c67b7effec2547e52cfee41c6f1accfa91e43e","observation_id":"0a649443-1dd9-4bdd-85e6-af880ae6dabb","resolution":{"observed_at":"2026-08-07T14:10:39.888835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.478100Z","title":"Multi-agent deep reinforcement learning: a survey,","venue":null,"work_id":"3ed23aab-9d0a-4046-889f-437c0b74d6ce","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.000558Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:892942379b393dae2570c4afa9e30db24041edd2c6e987dcdf87395b8ff8d176","observation_id":"19b15781-c7f6-473b-a831-fed5d4fdb583","resolution":{"observed_at":"2026-08-07T14:10:53.572138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-07T14:10:40.061190Z","title":"Multi-agent reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.061190Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c000a596e37fc0aae37c188672c4127ce1a8beba58790fcd50cfc0a2e55017bb","observation_id":"af5d2004-caaf-47b6-ac61-7b0028f94f0a","resolution":{"observed_at":"2026-08-07T14:10:40.061190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.438020Z","title":null,"venue":null,"work_id":"355aa3c7-a27b-4ab1-b0bc-76ad4d38980c","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.142181Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:309acabe1141e6d9530550395074e017676cc2b195860b0f04e3b6e5847d966a","observation_id":"c2aa99b8-35eb-4200-b516-85b06d7f88d6","resolution":{"observed_at":"2026-08-07T14:10:53.442394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.364436Z","title":"Multi-agent reinforcement learning for cybersecurity: Approaches and challenges,","venue":null,"work_id":"2a7fcd18-be63-434d-a9c4-985a34c669a2","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.249780Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ae3c36d467679dd8e7726cf1400afb6d12c0565d4994d016955a80f24b8ce500","observation_id":"1ecd6ec4-eecf-4aad-b681-13f389596325","resolution":{"observed_at":"2026-08-07T14:10:53.424997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.271306Z","title":"Design and analysis of decentralized interactive cyber defense approach based on multi-agent coordination,","venue":null,"work_id":"5a80681b-bd19-4bfb-93a2-38f9cac1756a","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.328375Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a082384aef5c1c81cb58e7628a14d80963cf3cde883081ec3e55f226c2fd620a","observation_id":"65b72d68-9080-4ad0-975d-dd80b058ffb0","resolution":{"observed_at":"2026-08-07T14:10:53.312361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00397","last_updated":"2022-03-01T12:46:28Z","snapshot_observed_at":"2026-08-09T11:51:06.995617Z","submitted_at":"2022-03-01T12:46:28Z","title":"A Theory of Abstraction in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00397","snapshot_observed_at":"2026-08-07T14:10:40.440922Z","title":"A theory of abstraction in reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.440922Z"},"links":{"cited_paper":"/paper/2203.00397","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2f812499d6f5623663ba2b713467c8b2e2325ec0571a921d94c2c2fa01333b90","observation_id":"62eff5e4-c4ae-4840-b3da-ab2cd23329e9","resolution":{"observed_at":"2026-08-07T14:10:40.440922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.04113","last_updated":"2017-01-15T21:24:45Z","snapshot_observed_at":"2026-07-06T05:26:15.624165Z","submitted_at":"2017-01-15T21:24:45Z","title":"Near Optimal Behavior via Approximate State Abstraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.04113","snapshot_observed_at":"2026-08-07T14:10:40.586964Z","title":"Near optimal behavior via approximate state abstraction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.586964Z"},"links":{"cited_paper":"/paper/1701.04113","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:90a94f83a735cece0a7596465602100cc6f92a1bf73df0ab1d11287474c4d0d1","observation_id":"6ff6a428-a5a0-4e4e-927c-c0c7e6c0fc70","resolution":{"observed_at":"2026-08-07T14:10:40.586964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.184816Z","title":"State abstraction as compression in apprenticeship learning,","venue":null,"work_id":"1b6e47a7-749f-41fd-b429-bba4c5e9b899","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.698039Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:39a72ef23e19c7cb005dc27ee1c5d0fbb78bc47e5553a3e826ca7576abe169bc","observation_id":"aefb4935-5878-4255-874e-83bc6c3ef637","resolution":{"observed_at":"2026-08-07T14:10:53.228262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.109849Z","title":"Non-cooperative games,","venue":null,"work_id":"07ae7089-f20d-4f86-970b-a2a6b6786730","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.810747Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:6ffd03bdb6fd53ef7d97e471dc0184cb2f69473eca2bf946705eb7002eaa35dd","observation_id":"e7aa530d-c830-4bdb-8584-1c1aabc71135","resolution":{"observed_at":"2026-08-07T14:10:53.149821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-07T14:10:40.916522Z","title":"Value-decomposition networks for cooperative multi-agent learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.916522Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:5f3660ffe8ef00a71da55e74bbb11ec456b7901501f1260bb018ccf34205b704","observation_id":"86418813-fa96-4e89-a298-ba470745546e","resolution":{"observed_at":"2026-08-07T14:10:40.916522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.890974Z","title":"State abstractions for lifelong reinforcement learning,","venue":null,"work_id":"e2f07683-d1d2-4e7f-85e2-50d65daebc13","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.017357Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:41ea46b94b08b3d03b858ac2043b89693980fd0f3523923eadb56d530866d186","observation_id":"a613a65b-22e2-4e79-83e2-77d332885e71","resolution":{"observed_at":"2026-08-07T14:10:53.024797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.576822Z","title":"Value preserving state-action abstractions,","venue":null,"work_id":"fb1b3d03-1adf-4885-807b-51851500687a","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.113473Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:22974724f9d53c48e9c1a173b0be2ba0d1bfac84f37c0e58a843092e0f373076","observation_id":"464967a7-de0e-4e07-b906-e026d03f375d","resolution":{"observed_at":"2026-08-07T14:10:52.728605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.240632Z","title":"Reinforcement learning: An introduction,","venue":null,"work_id":"011751d4-ffaa-40c8-aeb0-d64af51a403a","year":2005},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.227152Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:b7ea49760472ffa3f1c6da865faf4ccfe4d3cb591295b47183d2dfb3c613d31d","observation_id":"2cb04fc1-aa2c-481b-86ec-9d55d9377e5d","resolution":{"observed_at":"2026-08-07T14:10:52.394923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.946199Z","title":"Shoham and K","venue":null,"work_id":"b81fdb1f-86dc-4607-aea1-93d1d3e52171","year":2008},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.331019Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a83937cd29c6923d52fd31e281e41484ea4ebaa06b73a64719cede037eac5331","observation_id":"132674a2-08b2-4d12-b32b-90ecf049ba9f","resolution":{"observed_at":"2026-08-07T14:10:52.104769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.656831Z","title":"A game theoretic approach to decision and analysis in network intrusion detection,","venue":null,"work_id":"e712d707-1ed5-4d8d-b30e-420f131b9002","year":2003},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.401697Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ea87cc48e89291124146e591fb417582483056f83f721e5529f9b9149499b5b7","observation_id":"54e138e2-a881-4abb-9dc2-93445719ddc9","resolution":{"observed_at":"2026-08-07T14:10:51.813204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.380823Z","title":"Computing optimal randomized resource allocations for massive se- curity games,","venue":null,"work_id":"4985c136-b233-4950-bfbf-33c1ebe40ec7","year":2009},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.498939Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:269a5318c18eb165dc53cdfd9a35c5500c859c775ae7ca5bc498cfe6bcc131d7","observation_id":"6512679b-44f9-431f-aa89-be15c9da9600","resolution":{"observed_at":"2026-08-07T14:10:51.489671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.984593Z","title":"A review of attacker–defender games and cyber security,","venue":null,"work_id":"2a9627bb-cd3b-499b-a63f-16848d4b9be4","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.608105Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:687551fcbf5328ccd74066c8129946702861054a2142b2d621be4cf24b51e74d","observation_id":"0bb13fb0-f3de-4e88-9fe8-685f9d6d7853","resolution":{"observed_at":"2026-08-07T14:10:51.141016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.265158Z","title":"Dynamic games in cyber-physical security: An overview,","venue":null,"work_id":"18b85f2c-bc33-4e78-beab-ae35bf491fac","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.762018Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a64d7efb5e47bcadb7e58e78ebb3f66b44cd2587b0be66ed6bca463d0b45de46","observation_id":"20426748-ce73-45f0-a272-98e8f3d37fa8","resolution":{"observed_at":"2026-08-07T14:10:50.485982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.911064Z","title":"A pomdp approach to the dynamic defense of large-scale cyber networks,","venue":null,"work_id":"84bbadda-109a-458e-b599-2c1072ee7961","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.838137Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:f568a3db72870190c342fc9d88a70279077d2d659e5bca21cfb7f3c9d91fef7d","observation_id":"1581552d-6216-4bd3-a4b2-4d01ac466957","resolution":{"observed_at":"2026-08-07T14:10:50.089920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-75683-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":"Yu and R","venue":null,"work_id":"62763b0a-623c-4f44-afb7-ac383d7a5ed1","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.921146Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:02f4aad94fe9f34eab9644175bd08739efb7be73d1b8711d35d529e26ce62953","observation_id":"25d67249-29da-4609-998c-511e7ac7e3ab","resolution":{"observed_at":"2026-08-07T14:10:44.979994Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.08779","last_updated":"2015-11-27T20:01:45Z","snapshot_observed_at":"2026-08-06T21:19:58.365426Z","submitted_at":"2015-11-27T20:01:45Z","title":"Multiagent Cooperation and Competition with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.08779","snapshot_observed_at":"2026-08-07T14:10:41.979208Z","title":"Multiagent cooperation and competition with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.979208Z"},"links":{"cited_paper":"/paper/1511.08779","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:bf67bbf329dfc420c809b88bd678f7f39360681cae4b52f4d278309e3588b6d9","observation_id":"a2bf5d77-2fc3-46d0-b713-14ae3edb74ab","resolution":{"observed_at":"2026-08-07T14:10:41.979208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14471","last_updated":"2021-10-26T06:06:31Z","snapshot_observed_at":"2026-07-06T10:00:02.528060Z","submitted_at":"2020-09-30T06:42:09Z","title":"PettingZoo: Gym for Multi-Agent Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14471","snapshot_observed_at":"2026-08-07T14:10:42.069429Z","title":"Pettingzoo: Gym for multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.069429Z"},"links":{"cited_paper":"/paper/2009.14471","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a6f1dc269994cce50317f463d754dc73701d73dbbe1ba8236be3c3b1a5df6bc4","observation_id":"14835a00-abb9-47c7-9e06-4b32c9b2bd03","resolution":{"observed_at":"2026-08-07T14:10:42.069429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:42.144793Z","title":"Multi- agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.144793Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a0a753c1cdb5e5cc989cd6d85e9df8740a47f1f7921a75ae53c0e9f063358d04","observation_id":"caa26b1e-3ed6-4825-b8df-55dcfb072c4e","resolution":{"observed_at":"2026-08-07T14:10:42.144793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.645605Z","title":"Markov games as a framework for multi- agent reinforcement learning,","venue":null,"work_id":"03df221e-4bc9-49bc-b02d-744ed4034eca","year":1994},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.325063Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0bf722bfb3212ab4010c8ba145bb955b9304ce3c238d6345c1aea189d50b0409","observation_id":"fadcc624-5010-43d9-8c42-d39b4ed74bc0","resolution":{"observed_at":"2026-08-07T14:10:49.722049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08926","last_updated":"2024-12-11T14:05:03Z","snapshot_observed_at":"2026-08-10T18:47:45.911674Z","submitted_at":"2017-05-24T18:52:17Z","title":"Counterfactual Multi-Agent Policy Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.08926","snapshot_observed_at":"2026-08-07T14:10:42.409639Z","title":"Counterfactual multi-agent policy gradients,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.409639Z"},"links":{"cited_paper":"/paper/1705.08926","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:5c5b8ff1fb371a9bbb803f51fe7423114a6aca0b7a5fe34af252adbf51096670","observation_id":"433f8291-d7e6-42ed-b59a-90a9e52d0579","resolution":{"observed_at":"2026-08-07T14:10:42.409639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-06T12:03:41.509273Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-07T14:10:42.528804Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.528804Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a36f53ff0c4c791e4a059cf9c8af8ca8a7603962dd5fc53337336381c06fc211","observation_id":"66162488-6c90-4c99-a12c-707e2585dbe3","resolution":{"observed_at":"2026-08-07T14:10:42.528804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:10:42.618514Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.618514Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:cffd160338748d33cf78fc05c3f657fef03adcf1c1225a85b8da0e9fc2bbd3bf","observation_id":"00ae0741-ad49-4e0b-9693-d344a3f3e80c","resolution":{"observed_at":"2026-08-07T14:10:42.618514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T14:10:42.712252Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.712252Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:361fe8f5215f38c62ddd5363e50f4edff3b60e012d1a9c341dda043ede859ee1","observation_id":"8463c1e6-1c4a-4b5e-8678-8e0ffa96a375","resolution":{"observed_at":"2026-08-07T14:10:42.712252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.433812Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games,","venue":null,"work_id":"07c0fdd3-a7f7-42f8-880c-64fb1954eb64","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.802123Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:52f2c2de06568688eab0724a17ed1669ca2694585e5283e87393e8633df3a7c6","observation_id":"7f03e07d-4e9d-4cca-b3c4-c63aeb9b3c1d","resolution":{"observed_at":"2026-08-07T14:10:49.509553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.264313Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"5d28c791-60c3-40d7-bc96-22a2d4f9fda9","year":2014},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.952014Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:9b39fa681a8d13b9f104f9c9e39984b4210abff5a0626b9a4bbc8b43a3dd06fd","observation_id":"2bc2e6be-22f7-4686-94b1-4f8b7e2f6eb0","resolution":{"observed_at":"2026-08-07T14:10:49.344647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.084756Z","title":"Cyberbattlesim,","venue":null,"work_id":"a9a3e7ab-41ed-430a-a282-5ae97a4013f5","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.026152Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:275a043d14d4af83d4040335a8d9a345f95b937d102730ddac8b51baa1a3bac0","observation_id":"2c019d88-0bff-4a1f-81cd-e173715b3976","resolution":{"observed_at":"2026-08-07T14:10:49.177942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17246","last_updated":"2023-08-18T11:32:44Z","snapshot_observed_at":"2026-07-06T15:34:09.163519Z","submitted_at":"2023-05-26T20:19:09Z","title":"NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17246","snapshot_observed_at":"2026-08-07T14:10:43.095286Z","title":"Nasimemu: Network attack simulator & emulator for training agents generalizing to novel scenarios,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.095286Z"},"links":{"cited_paper":"/paper/2305.17246","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2ab73fb52225e000e653ae3209d29450fb95a8689496dac04dc7e6238cd26907","observation_id":"576103ca-3a31-422c-9b90-24d69c4f3825","resolution":{"observed_at":"2026-08-07T14:10:43.095286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13708","last_updated":"2023-11-06T10:21:19Z","snapshot_observed_at":"2026-07-06T14:09:56.872766Z","submitted_at":"2022-10-11T03:11:12Z","title":"MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library","version":4},"cited_work":{"arxiv_id":"2210.13708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.13708","snapshot_observed_at":"2026-08-07T14:10:46.132599Z","title":"MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library","venue":"cs.LG","work_id":"3b2b9b38-71ff-405a-b8d5-d3e36cd19a58","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.177576Z"},"links":{"cited_paper":"/paper/2210.13708","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d1774ac528149d0e56b6beaa4d6eccf88414f25597bfb6e843fe9cde17d7e31b","observation_id":"3b3a8c17-8a6e-44b4-9b62-fd332c91b719","resolution":{"observed_at":"2026-08-07T14:10:46.190469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-10T17:28:09.498763Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T14:10:43.252614Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.252614Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:8e36491ab395f4d4dd2a0241991e24f240175a12fa6a8f45ac9057bd2aa9a186","observation_id":"92c7db2b-d470-4bae-89d4-e589f727fc66","resolution":{"observed_at":"2026-08-07T14:10:43.252614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.890110Z","title":"Openspiel: A framework for reinforcement learning in games,","venue":null,"work_id":"530a4013-a204-4d03-9e8e-006d5691ff93","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.334397Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:fb8fda43816fef969e72f20ede946dc1fc194cc294adb1298e4246d8b9601f50","observation_id":"a86f7fa6-5157-4bd6-a203-a702b346840f","resolution":{"observed_at":"2026-08-07T14:10:48.991341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8475.28084","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:45.938829Z","title":"Vine: A cyber emulation environment for mtd experimentation,","venue":null,"work_id":"1b45a0cc-161c-4275-be37-c2f063e966ae","year":2015},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.474011Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:12aecc54e04e49e25dc483f09515edb392a977c31bd1f0367e44e01b7dab32a9","observation_id":"fba9c627-687a-4688-853f-fcffefd5472b","resolution":{"observed_at":"2026-08-07T14:10:46.023983Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10149","last_updated":"2024-01-18T17:22:22Z","snapshot_observed_at":"2026-08-06T12:41:26.207761Z","submitted_at":"2024-01-18T17:22:22Z","title":"Multi-Agent Reinforcement Learning for Maritime Operational Technology Cyber Security","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10149","snapshot_observed_at":"2026-08-07T14:10:43.536990Z","title":"Multi-agent reinforcement learning for maritime operational technology cyber security,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.536990Z"},"links":{"cited_paper":"/paper/2401.10149","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:821ff32731a11ca462233e91fc7e6aa879da149a40018f4e98d2b24b7f7d1aa9","observation_id":"4f728629-6a63-4c53-8c18-85cd4584f560","resolution":{"observed_at":"2026-08-07T14:10:43.536990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16324","last_updated":"2024-10-18T11:04:07Z","snapshot_observed_at":"2026-07-06T19:37:20.613838Z","submitted_at":"2024-10-18T11:04:07Z","title":"CybORG++: An Enhanced Gym for the Development of Autonomous Cyber Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16324","snapshot_observed_at":"2026-08-07T14:10:43.633319Z","title":"Cyborg++: An enhanced gym for the development of autonomous cyber agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.633319Z"},"links":{"cited_paper":"/paper/2410.16324","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e254fe5cd299d491a04b98ed200a08ff3cb80a1c1a68c5a72c53c3567e006551","observation_id":"d76b971b-2a29-4840-9b47-e9bb3098925e","resolution":{"observed_at":"2026-08-07T14:10:43.633319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09453","last_updated":"2020-09-26T11:49:05Z","snapshot_observed_at":"2026-08-08T18:52:56.345158Z","submitted_at":"2019-08-26T03:31:35Z","title":"OpenSpiel: A Framework for Reinforcement Learning in Games","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09453","snapshot_observed_at":"2026-08-07T14:10:43.393091Z","title":"Available: https://arxiv.org/abs/1908.09453","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.393091Z"},"links":{"cited_paper":"/paper/1908.09453","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e2fe0d8e7600ff586f40ed545e5bff7583477131b7457cc1e49b3fa2d0054b86","observation_id":"6ee9fcd7-5b99-4b88-8110-13ddb198f4eb","resolution":{"observed_at":"2026-08-07T14:10:43.393091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.531001Z","title":"Exploring the efficacy of multi-agent reinforcement learning for au- tonomous cyber defence: A cage challenge 4 perspective,","venue":null,"work_id":"b1b253a5-3655-40b1-a8ee-a25e8c078911","year":2025},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.883819Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:f82690354eb0403673edc7ee887700ae17d4dfd1f6c6a9bfff42723c5f66586c","observation_id":"f5cba973-7104-4267-9fc3-d242e87e9d22","resolution":{"observed_at":"2026-08-07T14:10:48.622940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.334823Z","title":"Towards an ai-powered player in cyber defence exercises,","venue":null,"work_id":"a08d4bdd-355c-47fb-a1b5-b6213a256bc3","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.975923Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:bcc6abcf9503152fa6efb3a0ae93c68090410d9f95fa830c7e22da8de973d7a9","observation_id":"97f0d783-314f-437d-920d-56e304a20b71","resolution":{"observed_at":"2026-08-07T14:10:48.423636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.07612","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:45.692012Z","title":"A survey for deep reinforcement learning based network intrusion detection,","venue":null,"work_id":"a49f841e-e1e0-4067-8738-7b7ae04bde55","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.098856Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:b7efb3cffb024b89c53d2f04fc910d24a371b751fad70bf7f8d5156e4f15ae5a","observation_id":"ce444609-fe8e-4584-8c37-0efb52ba47af","resolution":{"observed_at":"2026-08-07T14:10:45.767297Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.748866Z","title":"Cyborg: An autonomous cyber operations research gym,","venue":null,"work_id":"960a56c1-0d7d-430f-a905-2e489d677129","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.735855Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e8b869ed9376f72182ebb8a19855986c1a3191807415f19e7fb626d12ef1c421","observation_id":"c6b9e9c9-2d36-4d18-a789-34f6a54f3371","resolution":{"observed_at":"2026-08-07T14:10:48.803503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10667","last_updated":"2020-02-26T02:24:11Z","snapshot_observed_at":"2026-08-08T04:55:46.891516Z","submitted_at":"2020-02-25T04:59:24Z","title":"CybORG: An Autonomous Cyber Operations Research Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10667","snapshot_observed_at":"2026-08-07T14:10:43.802178Z","title":"Available: https://arxiv.org/abs/2002.10667","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.802178Z"},"links":{"cited_paper":"/paper/2002.10667","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:8a337278a1261fd591e92b15e26cea933dc38776ce2403fb0d880341ff7b0b05","observation_id":"6b3fb465-29d3-4841-98fd-a50cf7650883","resolution":{"observed_at":"2026-08-07T14:10:43.802178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.790938Z","title":"Csle: Cyber security learning environment,","venue":null,"work_id":"968cc7fb-a70b-4d4a-aeb1-795044f573e8","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.380779Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:f407905fa5bbb0c3f3cacff694cbc221d63cb12ac620d0645050ddc2beec383c","observation_id":"6e56e36d-f32b-46ae-9ae2-444f44f65f22","resolution":{"observed_at":"2026-08-07T14:10:47.840303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:44.447459Z","title":"Combating advanced persistent threats: Challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.447459Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3eef8b093854615cb0de4b803ca72607369b22e139c3468543801c07396202df","observation_id":"5cad2d08-770e-4e1b-a221-7967bcbcfec6","resolution":{"observed_at":"2026-08-07T14:10:44.447459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.632572Z","title":"Lateral movement (ta0008),","venue":null,"work_id":"b668aa79-597e-432d-81f8-72eab5ccacdb","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.551463Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e36c696f5fcf63f7659b22da37b37caffc2bf6fc8f0e9096ca95fcd513fe5489","observation_id":"af88656d-54e6-4c9c-b836-7630d44ba17a","resolution":{"observed_at":"2026-08-07T14:10:47.722260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.125147Z","title":"Deep q-learning based reinforcement learning approach for network intrusion detection,","venue":null,"work_id":"78604d15-8163-4060-918d-0ddf0a4e1323","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.160429Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:59a83ff5cf7d557667ce80e403544ad8a6546a754cb2c52b813d56a20da58307","observation_id":"6f2a2327-2cef-4cdd-9a84-35ce28378a04","resolution":{"observed_at":"2026-08-07T14:10:48.220895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.206877Z","title":"Exploitation of remote services (t1210),","venue":null,"work_id":"c6ffff2a-0b5c-463e-b1af-4b0314d618b5","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.683000Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:9635f3ab5f50a9697cf978828448cba785768e6cac1d6ea71ce2d907355a1c19","observation_id":"115bf963-b166-414b-87a5-242bec0624bd","resolution":{"observed_at":"2026-08-07T14:10:47.303119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.938429Z","title":"Cy- bershield: A competitive simulation environment for training ai in cybersecurity,","venue":null,"work_id":"4a628c26-6b99-400f-b576-c6de94dcfd3f","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.311218Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:674ad76044a961bfa2234f6ab181479e34116c1ce4760eaa2d38779509211254","observation_id":"02621236-e1f8-451d-8f82-dfe8b6be9aa8","resolution":{"observed_at":"2026-08-07T14:10:48.023140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13981","last_updated":"2020-10-06T01:25:03Z","snapshot_observed_at":"2026-08-07T22:54:58.065738Z","submitted_at":"2020-07-28T04:13:43Z","title":"Farsighted Risk Mitigation of Lateral Movement Using Dynamic Cognitive Honeypots","version":2},"cited_work":{"arxiv_id":"2007.13981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13981","snapshot_observed_at":"2026-08-07T14:10:45.199757Z","title":"Farsighted Risk Mitigation of Lateral Movement Using Dynamic Cognitive Honeypots","venue":"cs.NI","work_id":"228e35e7-2dd2-49a0-a3e7-539cfc0a5a1e","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.818148Z"},"links":{"cited_paper":"/paper/2007.13981","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a8fa03bbbf0c5c0c4a43d44b976af77f1b3cc8e0fa47a545af7b8dfeedd83068","observation_id":"937242ae-a1f3-4129-92b6-972b58465a0e","resolution":{"observed_at":"2026-08-07T14:10:45.257838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.422704Z","title":"Os credential dumping (t1003),","venue":null,"work_id":"9a3d03f0-117d-494a-91fa-b62b9d776dcc","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.621429Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:23685fea71e8eb8a5bccfd124963a1e99ba27e6e3e90aedb591369e4486dd821","observation_id":"13f801da-c42e-40f7-98dd-b4820fee3e50","resolution":{"observed_at":"2026-08-07T14:10:47.533296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:46.985673Z","title":"Privilege escalation (ta0004),","venue":null,"work_id":"df8e29a9-48e6-4d68-b223-6c4650db8622","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.743947Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d64321ad9355fe4f55e4de59be20b16b4463eff1af0054210829e0b830a0293c","observation_id":"79ba06a1-f19b-4172-a6c9-559343b2b65e","resolution":{"observed_at":"2026-08-07T14:10:47.131494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02275","last_updated":"2020-03-14T20:33:00Z","snapshot_observed_at":"2026-08-04T19:23:21.346128Z","submitted_at":"2017-06-07T17:35:00Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02275","snapshot_observed_at":"2026-08-07T14:10:42.258052Z","title":"Available: https://arxiv.org/abs/1706.02275","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.258052Z"},"links":{"cited_paper":"/paper/1706.02275","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:dfa3a88c2eb507a28d827ee0627a8c57221231395fd97fac32d277176362ab8b","observation_id":"a4950266-b309-4b29-885c-3877313e1841","resolution":{"observed_at":"2026-08-07T14:10:42.258052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.13978","last_updated":"2021-11-27T20:18:00Z","snapshot_observed_at":"2026-07-06T12:12:46.229217Z","submitted_at":"2021-11-27T20:18:00Z","title":"Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection","version":1},"cited_work":{"arxiv_id":"2111.13978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.13978","snapshot_observed_at":"2026-08-07T14:10:45.511819Z","title":"Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection","venue":"cs.CR","work_id":"d005a782-d039-40f1-887c-2132cd001b7c","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.236995Z"},"links":{"cited_paper":"/paper/2111.13978","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:243a4d5ddc2e968ff5e78020f69fffcfdedd0a63d99f42b671c6baa9f9118880","observation_id":"a6219ee9-f649-48ec-958a-4ade2951d41b","resolution":{"observed_at":"2026-08-07T14:10:45.551198Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01955","last_updated":"2022-11-04T06:16:11Z","snapshot_observed_at":"2026-08-11T01:59:05.518516Z","submitted_at":"2021-03-02T18:59:56Z","title":"The Surprising Effectiveness of PPO in Cooperative, Multi-Agent Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01955","snapshot_observed_at":"2026-08-07T14:10:42.885123Z","title":"Available: https://arxiv.org/abs/2103.01955","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.885123Z"},"links":{"cited_paper":"/paper/2103.01955","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3f4236ad0988d4d8f855925c97305ffbefbec015b1440138be7bc59d13a94ba4","observation_id":"c273e565-dba9-418f-a06a-1c828020ccd6","resolution":{"observed_at":"2026-08-07T14:10:42.885123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.634530Z","title":"Available: https://www.mdpi.com/2073-4336/15/4/28","venue":null,"work_id":"8c9ead8c-1e1f-4d60-b635-f261dd44e773","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.680463Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:5213c5da0bce841ad18a3c2b342e306e6725d6d6facd9cbd295571d957feb800","observation_id":"0c080564-5c4b-4180-98ff-f463f26ad388","resolution":{"observed_at":"2026-08-07T14:10:50.796686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-10T22:14:54.488663Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":24,"verified_exact":6,"verified_fuzzy":45},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2505.19837."}