{"as_of":"2026-08-11T19:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f62fb07cfb1ffd97ab302dfea1f2853a565ff9aa137e819d2973e97dbcf0e160","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T16:32:11.717573Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.09523/citation-record","integrity":"/paper/2604.09523/integrity","json":"/paper/2604.09523/citation-record.json","paper":"/paper/2604.09523"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.641790Z","title":"Intelligent simulation of APT operational trajec- tories","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.641790Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:f3f1aa7deb986ca4b05d12cfbea8ab2d196d412cd103c42d6881bee32c4528f3","observation_id":"b9754082-bd99-473e-ade1-e83958cb05cf","resolution":{"observed_at":"2026-08-02T16:32:11.641790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.646673Z","title":"Reinforcement learning in continuous time: Advantage updating","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.646673Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:12dd83a00472b76c3cbda79e8b8f956dcc2e5dd55ba49f9bf51d4f32486a9afa","observation_id":"95d1798e-6bd1-4d99-8bb5-dcac4d1e421f","resolution":{"observed_at":"2026-08-02T16:32:11.646673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.650768Z","title":"Machine learning cybersecurity: bridging the sim2real gap","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.650768Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:47c759482c08de42bdacb93fac696a350bf0b5b265681ecda0f8422b7043794f","observation_id":"c07efa17-a29d-486a-bf52-54aae763845f","resolution":{"observed_at":"2026-08-02T16:32:11.650768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.654983Z","title":"Neural ordinary differential equations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.654983Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:672c6e49f17f5cc5ceb169f375fd5c8215eee4b032660fab6d266cd87ffa2074","observation_id":"8aa2675e-592c-420a-9784-11f5d38eb5bb","resolution":{"observed_at":"2026-08-02T16:32:11.654983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-02T16:32:11.659378Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.659378Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:53414474446a2e9c4390de0b7993af9e3bcd3fa30d1e2da62a7e862f874c4be1","observation_id":"f635bde3-7426-4c80-bcfc-308eb9e186a3","resolution":{"observed_at":"2026-08-02T16:32:11.659378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.664276Z","title":"Reinforcement learning in continuous time and space.Neural computation, 12(1):219–245, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.664276Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:dd78b46f5acfdd6af989a3327eb618fe80008dc40e7e8c1c36a2c715615572db","observation_id":"637bafdb-d9ea-48bf-830d-9b7319258953","resolution":{"observed_at":"2026-08-02T16:32:11.664276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.668940Z","title":"Graph convolu- tional reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.668940Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:e8bcabe1b26b5d0d41fd19681d843c2bef2d8882505e4a528e89f73232ed4a7e","observation_id":"d4f73c18-e396-4cf7-acca-545d19f8a7e8","resolution":{"observed_at":"2026-08-02T16:32:11.668940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.672729Z","title":"Planning and acting in partially observable stochastic domains.Artificial intelligence, 101(1-2):99–134, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.672729Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:0de9a5a8063b090e2b1a33716e227eb76de9e008d9ab1f9a47d274b631747544","observation_id":"c425bca3-02b4-40b5-a3b8-8d84b6d41345","resolution":{"observed_at":"2026-08-02T16:32:11.672729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.676654Z","title":"Multi-agent actor-critic for mixed cooperative-competitive envi- ronments","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.676654Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:2e26af086bab85c48ecfdad7df670c68c9bc9cdd766547cbae10cf6bdf7a5372","observation_id":"805a167a-05cb-4bda-8e5d-6020eaa15ea2","resolution":{"observed_at":"2026-08-02T16:32:11.676654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.680508Z","title":"QMIX: Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.680508Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:0bd197dc49cf52dad279b8160c1b2789c325181ad23f270eb6746e24adf38152","observation_id":"ee659d63-5bcd-4f51-b543-c86ec04404b0","resolution":{"observed_at":"2026-08-02T16:32:11.680508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.684555Z","title":"Zero trust ar- chitecture","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.684555Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:73ae99c7890091a6987c4125534344c7e8a47c36dce86919d8cddcb3f09a13bd","observation_id":"28f7c007-b509-47f7-97db-0cbdebe700e8","resolution":{"observed_at":"2026-08-02T16:32:11.684555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.688394Z","title":"Latent ordinary differential equations for irregularly-sampled time series","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.688394Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:14b61a1daa47e7df43440eaad9672713980719b89f0076ef6cabf24669f20bd1","observation_id":"e5693884-1df3-4466-aef6-abffc74d18ee","resolution":{"observed_at":"2026-08-02T16:32:11.688394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-02T16:32:11.692499Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.692499Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:77998846b2b0b0d09f42a5f33adcc14311956a248bad711537df152fab4477f6","observation_id":"e74aee8e-8673-4339-b9a6-3e5f838ba1c4","resolution":{"observed_at":"2026-08-02T16:32:11.692499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.696691Z","title":"NASim: Network attack sim- ulator","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.696691Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:2f25e24f47e59a2975d831406f9d7d9bc6527d7450c0ac71a1a7d296515f2510","observation_id":"e38b82b4-6b82-4554-9984-9ae0d27e45fd","resolution":{"observed_at":"2026-08-02T16:32:11.696691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09118","last_updated":"2021-08-20T11:32:23Z","snapshot_observed_at":"2026-07-06T11:40:04.439507Z","submitted_at":"2021-08-20T11:32:23Z","title":"CybORG: A Gym for the Development of Autonomous Cyber Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.09118","snapshot_observed_at":"2026-08-02T16:32:11.700729Z","title":"CybORG: A gym for the development of autonomous cyber agents.arXiv preprint arXiv:2108.09118, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.700729Z"},"links":{"cited_paper":"/paper/2108.09118","citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:2f5cc74730cae69e0f33db7a6cd417f8b922c673fb5c2ef4adebbad36cec55d6","observation_id":"af239d2a-8572-4417-956b-28c2c15d53ad","resolution":{"observed_at":"2026-08-02T16:32:11.700729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.705273Z","title":"MITRE ATT&CK: Design and philosophy.Technical report, The MITRE Corporation, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.705273Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:52c0e7d2ece56829c08e50acb5e345a5dc3d1e4e1bcf0d6fcb4fed7873ee3b24","observation_id":"faae47dc-6882-4eea-842f-387206064aa1","resolution":{"observed_at":"2026-08-02T16:32:11.705273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.709419Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.709419Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:1dff07dfc503ee46acbccba3fe7824c401d8c11429b712f10a60c0ec4f3f5793","observation_id":"22e9e599-435d-48a0-a331-c5ae71f371bc","resolution":{"observed_at":"2026-08-02T16:32:11.709419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.713529Z","title":"MiniLM: Deep self-attention distillation for task-agnostic compression of pre-trained transformers.Advances in Neural Information Processing Systems, 33:5776–5788, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.713529Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:b3f313faea65662f224ef4c7549af5bad2f2abfd5d89f32becf5c467c57380b6","observation_id":"2ee2c9b0-7a38-4436-bc2f-4b73a826b9f5","resolution":{"observed_at":"2026-08-02T16:32:11.713529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T16:32:11.717573Z","title":"The surprising effectiveness of PPO in cooperative multi-agent games","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T16:32:11.717573Z"},"links":{"citing_paper":"/paper/2604.09523"},"observation_digest":"sha256:ee1998fbdcac3333e6fdeb394afa6b6533200c4d69406ab2642bafe604c988ea","observation_id":"64b2fd41-c6b4-468a-b012-16520a931fb9","resolution":{"observed_at":"2026-08-02T16:32:11.717573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.09523","last_updated":"2026-07-15T07:42:58Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T16:32:10.870217Z","submitted_at":"2026-04-10T17:44:29Z","title":"NetForge RL: A Multi-Agent Simulation Environment for Cyber Defense with Durative Actions"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2604.09523."}