{"as_of":"2026-08-09T03:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5d8fa6db30d02df0f8c5cb7ba7157987c9c634379ed9b61b12fb881a9e27918","coverage":[{"denominator":154,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:15:10.053731Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:46:41.137112Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T08:11:03.819865Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"cited_work":{"arxiv_id":"2602.08690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.08690","snapshot_observed_at":"2026-06-23T04:13:44.442522Z","title":"arXiv preprint arXiv:2602.08690 (2026)","venue":null,"work_id":"e344ba33-a9f2-4814-aee1-d13b7a768252","year":2026},"citing_paper":{"arxiv_id":"2604.08805","last_updated":"2026-04-09T22:41:01Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-09T22:41:01Z","title":"Building Better Environments for Autonomous Cyber Defence","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:41.137112Z"},"links":{"cited_paper":"/paper/2602.08690","citing_paper":"/paper/2604.08805"},"observation_digest":"sha256:78711a20ee21f20cc7782b9aa79d31cced9eaf1cf8c1a10cac8dcc30aeda2e69","observation_id":"da4a0ec6-b9eb-4379-b446-073292b874ea","resolution":{"observed_at":"2026-06-23T04:13:44.442522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.08690/citation-record","integrity":"/paper/2602.08690/integrity","json":"/paper/2602.08690/citation-record.json","paper":"/paper/2602.08690"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.778365Z","title":"Created by Maxwell Standen, David Bowman, Son Hoang, Toby Richer, Martin Lucas, Richard Van Tassel","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.778365Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d3785c032e71c2298d8a626e98bf2e0fee9cdbeb2aaccc9244630d9b29e8410b","observation_id":"df3ff68c-83b4-483a-a115-e33081f5252d","resolution":{"observed_at":"2026-08-03T03:15:09.778365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.782041Z","title":"Created by Maxwell Standen, David Bowman, Son Hoang, Toby Richer, Martin Lucas, Richard Van Tassel, Phillip Vu, Mitchell Kiely","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.782041Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:4395aba1a87cbdfe3747d3afdcee031e285ca9fdb33ddb54e59ba21e9f6f7aef","observation_id":"5f82f4dc-a06c-491f-afa0-bd4a1bb0f44e","resolution":{"observed_at":"2026-08-03T03:15:09.782041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.785117Z","title":"Adkins, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.785117Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:a3a6f36ded03e8073341b6a13be1bfe47f4b3152e86f6b704f513f385dea3d2b","observation_id":"e358b6e8-44b0-46a8-b5fe-68fade36656e","resolution":{"observed_at":"2026-08-03T03:15:09.785117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.788291Z","title":"Agarwal, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.788291Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:483ed046e523e9163a3c8d62c2e434adc2ad6ef40b2225b20767c79f5ec27e7f","observation_id":"07bbf896-35a3-4a88-910e-3de8b5b78183","resolution":{"observed_at":"2026-08-03T03:15:09.788291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.791249Z","title":"Agarwal, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.791249Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:8a51e5a0c4d32d7ef6306cf85686ace07e8fb8b00ece50bd65a3b7554ea469c6","observation_id":"08db024e-e004-4268-a85c-37e4b7c4647a","resolution":{"observed_at":"2026-08-03T03:15:09.791249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.794347Z","title":"Al-Fawa’reh, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.794347Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:aa814be9c74498ecfbc429fc409e64f8156b82bd744b31867b9d69ea8e56f65e","observation_id":"1b74d2c5-6c07-45c4-a1ac-c35ac2306ca6","resolution":{"observed_at":"2026-08-03T03:15:09.794347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.797853Z","title":"Al Wahaibi, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.797853Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:9bca3e0e31d420b5bf02cc2ce557ae3a1b24e7c21ddb4dd1d73520ab7d48ce39","observation_id":"7527c350-ba1d-4ed0-ab93-a3d072ea3a37","resolution":{"observed_at":"2026-08-03T03:15:09.797853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08917","last_updated":"2018-01-30T15:16:37Z","snapshot_observed_at":"2026-07-06T06:20:26.483102Z","submitted_at":"2018-01-26T18:03:07Z","title":"Learning to Evade Static PE Machine Learning Malware Models via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08917","snapshot_observed_at":"2026-08-03T03:15:09.800647Z","title":"Kharkar, B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.800647Z"},"links":{"cited_paper":"/paper/1801.08917","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:68eef72442b32284bd1d379754b00e75a7fdb41f85aeb060ff0d89f2412b5d27","observation_id":"5bd499f2-18ac-4c15-a8a3-0eab06669f29","resolution":{"observed_at":"2026-08-03T03:15:09.800647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.803956Z","title":"Andrew, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.803956Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:4381f6bf75589d54bae0ca1733477ea5739c966dfe21605b927082205965106f","observation_id":"ff357e28-9a52-4ed9-ae1f-9e75fe0a80ac","resolution":{"observed_at":"2026-08-03T03:15:09.803956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.807023Z","title":"Applebaum, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.807023Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:45500d4fecd09fc3cac9171d697637f4e9ce5ee81593ddc40eb5cf0ed505498f","observation_id":"5afa8bc7-632d-40c6-bd22-af541538804b","resolution":{"observed_at":"2026-08-03T03:15:09.807023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.810020Z","title":"Apruzzese, M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.810020Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:b49a9b2c4bca6009dc7a5fcd229e1c6afcd176dcb806519583fb68c9a06e3b97","observation_id":"ae3597b7-bf08-4695-86ce-7ec574d648ce","resolution":{"observed_at":"2026-08-03T03:15:09.810020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.812800Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.812800Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:9660c305bc7b023ef9084011b3df8eb6a7bb3b5ce735df1723443012c7345539","observation_id":"bbc9e51b-782e-4a13-ba27-972c6d438c79","resolution":{"observed_at":"2026-08-03T03:15:09.812800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.815379Z","title":"Arulkumaran, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.815379Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:30bddff6536d5671234c80c34b46a5327b7d02e01647b66cf143bed7895225c6","observation_id":"23a0fefa-e378-4f03-8f07-a097450a28f1","resolution":{"observed_at":"2026-08-03T03:15:09.815379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.818088Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.818088Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:7dae9a8cf0ac81f14629ae5226d97ad5ceb410a26e5387f7801b3617b15817a9","observation_id":"1836a92d-8f62-4881-ac2b-e0eba830df20","resolution":{"observed_at":"2026-08-03T03:15:09.818088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.821336Z","title":"Bates, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.821336Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d19a4a90ed190de15fa766aa22bb5fc2ba36f9bc27444d012308cf63e2e2feff","observation_id":"b3399342-1a07-4405-9853-ccab3a6ba344","resolution":{"observed_at":"2026-08-03T03:15:09.821336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.823908Z","title":"Beyond rewards in reinforcement learning for cyber de- fence, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.823908Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:6b5af6065ddb7a5177ff0544beb28ed03a5c51127147e24355ca479913e9e6e0","observation_id":"f6d8a231-e664-49cf-b92b-ece5b12bad61","resolution":{"observed_at":"2026-08-03T03:15:09.823908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-03T03:15:09.826615Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.826615Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:c8a75ecdda6ce160713aafab0d62ac4464777448a2298c88f6c46b107f1d3167","observation_id":"ce9b109d-b0b8-4101-bb63-94cd96f05656","resolution":{"observed_at":"2026-08-03T03:15:09.826615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.830167Z","title":"B ¨ottinger, P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.830167Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:e463aa7c799c23345750b2f20c81c7c9c66cd8c10bc05994cf4c7a7526ce3a31","observation_id":"30fef07e-8202-4a08-b6a0-0b1019e8c4e0","resolution":{"observed_at":"2026-08-03T03:15:09.830167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.832904Z","title":"Boutilier, T","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.832904Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:20f1c3d4ba524c4963f2b369173956e159646f2c3587057ccf45974540269400","observation_id":"88b7e6d1-e67a-4242-9d50-0f3d91e35306","resolution":{"observed_at":"2026-08-03T03:15:09.832904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-07-06T07:11:32.319931Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-03T03:15:09.835966Z","title":"Burda, H","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.835966Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:b5605eff074d22f69d46736b208fb3a177cbdc438c77e761de8122abb3faeb0d","observation_id":"272143ee-e566-4bab-af68-261851b6c40a","resolution":{"observed_at":"2026-08-03T03:15:09.835966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.839239Z","title":"Caminero, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.839239Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:555415e04f6b78b3fad024cae2507ed008a1e79b8df06db1f89881c0cec1db88","observation_id":"9d1c3226-d612-4f55-a1a9-a882299d361d","resolution":{"observed_at":"2026-08-03T03:15:09.839239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.842252Z","title":"Cavenaghi, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.842252Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:2c7442b86d3324eac61c23f55de0b375baf68acdf1ed07c4d54806d7350a3265","observation_id":"f8edf2b0-821f-4bb1-a06c-9f9d4706b2fe","resolution":{"observed_at":"2026-08-03T03:15:09.842252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.05663","last_updated":"2020-02-12T19:23:15Z","snapshot_observed_at":"2026-07-06T08:43:55.093635Z","submitted_at":"2019-12-10T17:50:33Z","title":"Measuring the Reliability of Reinforcement Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.05663","snapshot_observed_at":"2026-08-03T03:15:09.845886Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.845886Z"},"links":{"cited_paper":"/paper/1912.05663","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:240e13b9f845cee816d32d49d08723f47c6b4129345be668211509d5a2fdb77c","observation_id":"339e7f89-55ec-4de5-a959-0e9b60b36113","resolution":{"observed_at":"2026-08-03T03:15:09.845886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.849093Z","title":"Chatterjee and Akbar-Siami Namin","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.849093Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d3b25cde8c9ad0f326519962219fe15bb951e2972497b52dae74cd2db7de7cb8","observation_id":"36b3c8db-827a-4a43-a6fd-849410eace45","resolution":{"observed_at":"2026-08-03T03:15:09.849093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.851992Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.851992Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d03e982778e345f175ea85aa798a92cd3d572bf766cfa40ba2fef60c25c3f5f1","observation_id":"815dfd8d-bee5-4a0e-9154-8ae45eb75856","resolution":{"observed_at":"2026-08-03T03:15:09.851992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.854750Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.854750Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d512175200a4b860882aa91a478dee5d439bf9d6c0dc630ade2b49753e017e8a","observation_id":"004f208c-dc06-4be1-92e2-8dca16de6482","resolution":{"observed_at":"2026-08-03T03:15:09.854750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.857706Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.857706Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:0dd687aea7e02c5e5f4abfb929ea049e61a14a5cb6b0c35bd6f0be6fe460185e","observation_id":"93d20245-72c5-46ae-852f-0997fb39a085","resolution":{"observed_at":"2026-08-03T03:15:09.857706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.860411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.860411Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:30cdab7de0fe4d5890e6f636f90961bb43380e17e64837523ad1264bd9e9ca18","observation_id":"443f22e1-53e7-45f2-a35c-fedc600bf774","resolution":{"observed_at":"2026-08-03T03:15:09.860411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.863577Z","title":null,"venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.863577Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:546cb6f122eb65887c3069fe3603765f21cf20b594c50253006841537077f02c","observation_id":"1b75d5b0-1b77-4ad5-93c2-a7f4565b0f57","resolution":{"observed_at":"2026-08-03T03:15:09.863577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.866140Z","title":"Colas, O","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.866140Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:16fe1f55403f6b9f52275aa35b42109a09b576e921e97260ccf052185066b87b","observation_id":"d7de28be-5ed1-4ebf-8e4c-49584431cb1a","resolution":{"observed_at":"2026-08-03T03:15:09.866140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.868781Z","title":"Collyer, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.868781Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:260ff6800646cd7fdc397ca519540f6fb80121b53b19611b1a8d790c98710122","observation_id":"82caaba0-c05f-4012-a02c-65932f2ba4ef","resolution":{"observed_at":"2026-08-03T03:15:09.868781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.871654Z","title":"Corradini, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.871654Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:52c3f6f28f47bebf4fc27f41dc8162c377e87767057e5c04c51d3e929db1e3f6","observation_id":"6b77f1e3-17c1-49d9-933b-9e476596d17c","resolution":{"observed_at":"2026-08-03T03:15:09.871654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.874169Z","title":"Dabney, G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.874169Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:2584ded3c66da7a2ad3c13be2daab8d55c10a42d3b1f587cf95906f0b9827b91","observation_id":"bf1931f4-3d43-414b-becf-b0611c8bb1c1","resolution":{"observed_at":"2026-08-03T03:15:09.874169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.877023Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.877023Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:1446dbd6d3e21b936307804992b22929fa335f1be4b3cfa7e1f2c22d24cff9b8","observation_id":"c42b846f-f353-4b8c-bbac-bb5dc198ed72","resolution":{"observed_at":"2026-08-03T03:15:09.877023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.879906Z","title":"De Silva, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.879906Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:2794adfa8f3cd2554a992cc8b1004d20fb7cb7b8782d257f81a17084b71089c8","observation_id":"c733322b-881b-4f87-afa1-031b5d43b1c2","resolution":{"observed_at":"2026-08-03T03:15:09.879906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.882494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.882494Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:85dd7a5ea279c23869660ca62bde2f60e0e94e09ea3599d78d6f8c064567d6b1","observation_id":"fe5d7787-dbdc-4255-9eef-2bb2f4dcd305","resolution":{"observed_at":"2026-08-03T03:15:09.882494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.885279Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.885279Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:55bf55d26f7803774e5a420120925c8d3e696dfec368dc2b74520afe4f208668","observation_id":"59dbbaaf-e995-4f0d-a1b5-1fcf4c512824","resolution":{"observed_at":"2026-08-03T03:15:09.885279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-03T03:15:09.888113Z","title":"Dulac-Arnold, D","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.888113Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:f14d48ceeee48d46989f88a38a62601e581c6cd2c26e8b877dec75a976603831","observation_id":"0e5b0c62-485a-461c-b3d6-dd93fc63e6eb","resolution":{"observed_at":"2026-08-03T03:15:09.888113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.891389Z","title":"Eimer, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.891389Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:5b55e61eb6370e7ec4d45f8c7c62ac48a3742b5f81568f84a2a206207c25c439","observation_id":"4de0b8f9-2d2c-4464-a7e0-d9b4dadb10d6","resolution":{"observed_at":"2026-08-03T03:15:09.891389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.894002Z","title":"Emerson, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.894002Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:94db5c992812329c27e8b70e14ec410fe0ba92a32e944ab8893491f8d49dce9c","observation_id":"0b989531-b9b7-41d0-b865-2e93c2fa0101","resolution":{"observed_at":"2026-08-03T03:15:09.894002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.896674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.896674Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:125bff8562c692024893b2cc39c3af3123858da1b13050d495c20def1d1f8a96","observation_id":"e5b96df9-4520-4db0-bba1-4ac31eb51971","resolution":{"observed_at":"2026-08-03T03:15:09.896674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.899929Z","title":"Erd ˝odi, ˚A Sommervoll, and F","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.899929Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:e6a5b94ffe3ec09c5d58b043875182944c7956a0fa117e392499d90877c8cb45","observation_id":"f6106954-54f2-42e2-9b3c-18ee0b27b29f","resolution":{"observed_at":"2026-08-03T03:15:09.899929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.902517Z","title":"Evertz, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.902517Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:7080de67c776bce9b3f9875bcff88674e6e351c7fd43c021e396676380ab875b","observation_id":"17dfed62-7d7e-4d59-96ac-20b310881ec1","resolution":{"observed_at":"2026-08-03T03:15:09.902517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.905271Z","title":"Faillon, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.905271Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:078fd3d445b1627ffbb8e9e5fb5be513e6053b609cc256c7d615e08d066486b8","observation_id":"b60b782b-77d6-4c3d-a7b9-d94eeb30fcba","resolution":{"observed_at":"2026-08-03T03:15:09.905271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.907675Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.907675Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:75ca397811e85767791a1f4741dc001f12a3940bb46925f4b314ce83adf1cb88","observation_id":"311b314e-ea77-4a55-9fdd-cfbfe1f452e7","resolution":{"observed_at":"2026-08-03T03:15:09.907675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.910359Z","title":"Fawzi, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.910359Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:11d30f9e7eddc3d3465362b29939c39823fd190ad1136530a557488faa664414","observation_id":"d50d30e8-a9c6-4897-938a-a12a75f4724c","resolution":{"observed_at":"2026-08-03T03:15:09.910359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.913094Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.913094Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:16b3741c3c5ac75893192ebe5fca88362e62873426bf94ad324204f34e0ca434","observation_id":"e23ab54d-1dfa-41f4-ae43-0e867b8b7d5c","resolution":{"observed_at":"2026-08-03T03:15:09.913094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.915649Z","title":"Foley, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.915649Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:1f8ae2e006d337a503a473859fe74430f44df51491ac72e9b518a025629cf854","observation_id":"b0b97e3a-dcb0-46e4-9173-12ecd4aad9f3","resolution":{"observed_at":"2026-08-03T03:15:09.915649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.918347Z","title":"Foley and S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.918347Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:66c59549df1bdedf0d2ab9bfdaa06b653e00a8ad8c28f5844e3e7b9439f646c1","observation_id":"9693a93e-58f0-41d9-8c55-faeb13ec7fd2","resolution":{"observed_at":"2026-08-03T03:15:09.918347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.921523Z","title":"Foley and S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.921523Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:7a7df2134339a624dd8b4749b04144555356926230e30a3e9aeba71a254885d5","observation_id":"c23b3602-fed9-44fd-abb6-6777788c3164","resolution":{"observed_at":"2026-08-03T03:15:09.921523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.923907Z","title":"Foley, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.923907Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:581fd54397ba217d87c5a18d6a3fc050ed8f5f388c2e36472ccc5869ea7303f7","observation_id":"d1c7d651-99e6-4063-8663-4a24e29f2029","resolution":{"observed_at":"2026-08-03T03:15:09.923907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.926619Z","title":"Gangupantulu, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.926619Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:878fddb5d49ff32dfffdb548375fd537037f2bf1c69de34cde06b41b5c24f7e2","observation_id":"d453ac1f-647b-4e35-b91f-25bc5bf7ef0d","resolution":{"observed_at":"2026-08-03T03:15:09.926619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10615","last_updated":"2021-01-17T19:25:56Z","snapshot_observed_at":"2026-08-04T07:21:33.793111Z","submitted_at":"2019-05-25T15:23:19Z","title":"Adversarial Policies: Attacking Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10615","snapshot_observed_at":"2026-08-03T03:15:09.929179Z","title":"Gleave, M","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.929179Z"},"links":{"cited_paper":"/paper/1905.10615","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:3c63d78f791ca7fd5d43056cc540d2d055731dd9e775ba7e19fa22ba1a66be57","observation_id":"15c259b0-7f1e-4ef1-94e3-72f758120ec0","resolution":{"observed_at":"2026-08-03T03:15:09.929179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.932100Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.932100Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:90b4a8daecc7786b77ecb4b33204bd532117b479c3c686d93996d27e68141f80","observation_id":"53a628a1-05c1-4bfc-9129-8d081c9dedc5","resolution":{"observed_at":"2026-08-03T03:15:09.932100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.934501Z","title":"Gohil, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.934501Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:934329007d89278df66c67b5e31e0074cfce1a68c3a2d37da88e94fc8f6a77ba","observation_id":"13c21b26-3899-4fb8-9a2b-ddf96b19d400","resolution":{"observed_at":"2026-08-03T03:15:09.934501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.936931Z","title":"Gohil, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.936931Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:ed13f8020d965cdf7a4537ed060985b0af32f41efbe981f0f415d023ce6bac91","observation_id":"fb79d636-6b3b-4f44-aa0a-4d3f9e5bbf3d","resolution":{"observed_at":"2026-08-03T03:15:09.936931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.939350Z","title":"Ttcp cage chal- lenge 3.https://github.com/cage-challenge/ cage-challenge-3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.939350Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:888963e7fee8661c004b74f13027b692e90637c763088d07d7ee78930e77fc60","observation_id":"3b322cc0-c95e-459a-8b3c-cff8e684c6fa","resolution":{"observed_at":"2026-08-03T03:15:09.939350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.941848Z","title":"Ttcp cage chal- lenge 4.https://github.com/cage-challenge/ cage-challenge-4, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.941848Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:fc009236dc442a7a1a83429778741795bc2e066769a6d5a37fcfd71a26f85d77","observation_id":"c9595248-4214-4c35-999c-2554e6e30663","resolution":{"observed_at":"2026-08-03T03:15:09.941848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.944258Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.944258Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:29b9e54fac2a5245da5adcbc293e3374947c4f0409b1bf78a51e79ec3d83bc64","observation_id":"26e1da50-7ac6-4a62-b337-9eebe51556e7","resolution":{"observed_at":"2026-08-03T03:15:09.944258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.946632Z","title":"Hausknecht and P","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.946632Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:1e2bf442401b79db61f537bcec819cad36400b9fefffcdb7071d6da39215df98","observation_id":"5bd72e83-e30f-4f22-aaa1-e79a8f968694","resolution":{"observed_at":"2026-08-03T03:15:09.946632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.949150Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.949150Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:a48cd6b236c9a228591aeef8bf784b1cc7da7c11ed2ee9a88d667f001fd1c8ef","observation_id":"e83c17e8-5f2e-4fc3-acb2-267050f33ad5","resolution":{"observed_at":"2026-08-03T03:15:09.949150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.951461Z","title":"Henderson, R","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.951461Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:38301464828b98c43c64c5dcb0145a693083d39d7880064e313b67235062dcd5","observation_id":"376e0d53-2a32-4fa0-a83e-b9623a867c6c","resolution":{"observed_at":"2026-08-03T03:15:09.951461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02908","last_updated":"2019-07-05T16:14:55Z","snapshot_observed_at":"2026-07-06T08:05:24.076802Z","submitted_at":"2019-07-05T16:14:55Z","title":"On Inductive Biases in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02908","snapshot_observed_at":"2026-08-03T03:15:09.953851Z","title":"Hessel, H","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.953851Z"},"links":{"cited_paper":"/paper/1907.02908","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:deadd294bdf1255a2d25bc307bb790d98969db5cd8ef4293ad96f287db3bbda9","observation_id":"92cce13c-e720-41bc-969f-9264d1278750","resolution":{"observed_at":"2026-08-03T03:15:09.953851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.956469Z","title":"Hicks, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.956469Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:94c474f383d6d1fbd3dca5b237c059caf0c0c0a1a3fab1c3c277cdf14f94bf31","observation_id":"370e90af-38dc-4d56-b6af-f97d61b9508c","resolution":{"observed_at":"2026-08-03T03:15:09.956469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.958827Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.958827Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:469e3960fadb74d45648547ea5b79aeceb3e158f205788d7710f3b00708fb99a","observation_id":"f721aac8-6fd6-4010-89f7-af069076397f","resolution":{"observed_at":"2026-08-03T03:15:09.958827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01798","last_updated":"2020-08-04T19:02:57Z","snapshot_observed_at":"2026-07-06T08:41:52.497343Z","submitted_at":"2019-12-04T04:48:21Z","title":"SquirRL: Automating Attack Analysis on Blockchain Incentive Mechanisms with Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01798","snapshot_observed_at":"2026-08-03T03:15:09.961548Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.961548Z"},"links":{"cited_paper":"/paper/1912.01798","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:a4f337d789a178f013b9eff4b8148fcdb6f9e66c0f8e4abde0c559f4719f84e8","observation_id":"e9d00cfd-ccce-4741-ae37-0925c1efdb6b","resolution":{"observed_at":"2026-08-03T03:15:09.961548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.964133Z","title":"Hsu and M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.964133Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d8bf52a3601d8091545a2351b358c3d6280c4476d4688e9c5ba49a201922d972","observation_id":"7a52a833-700e-4b64-b623-46c3be3511cf","resolution":{"observed_at":"2026-08-03T03:15:09.964133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.966775Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.966775Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d76007b1e5aefe48ab8789b565be8e03744b692d52393cc3c18bae39401c8fdc","observation_id":"6d276a13-3349-4858-95be-d866acd43687","resolution":{"observed_at":"2026-08-03T03:15:09.966775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.969146Z","title":"Jumper, R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.969146Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:8cd00465a047145133c8b666b5abb709d1e80180455c27afa4923f4fab31f5e2","observation_id":"12a65293-f836-4f4d-afed-8f89ca7eca1f","resolution":{"observed_at":"2026-08-03T03:15:09.969146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.971677Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.971677Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:42c4ccf4c071ded8ec8d368c15c19456144ee174ec8040c918f9db53c6618a33","observation_id":"a4bcdbcd-8485-4da5-a2c6-808fce26cc4e","resolution":{"observed_at":"2026-08-03T03:15:09.971677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-07T15:39:37.899352Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-03T03:15:09.974165Z","title":"Kaiser, M","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.974165Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:a607d96529be79aa01c450d64b4632b2ecda7c67972b9b4993a73de8170770c8","observation_id":"0e6e0af5-d3a0-47eb-a7d8-b781195bb902","resolution":{"observed_at":"2026-08-03T03:15:09.974165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01359","last_updated":"2025-04-09T12:32:21Z","snapshot_observed_at":"2026-07-06T17:24:16.787573Z","submitted_at":"2024-02-02T12:27:32Z","title":"TESSERACT: Eliminating Experimental Bias in Malware Classification across Space and Time (Extended Version)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01359","snapshot_observed_at":"2026-08-03T03:15:09.977417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.977417Z"},"links":{"cited_paper":"/paper/2402.01359","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:efefd0e09d37a8f9361fc08918d8e544c92fcb653bb7dc72007e2939770ac99a","observation_id":"21715484-6bf0-4f8f-83db-ba06b7fc81bd","resolution":{"observed_at":"2026-08-03T03:15:09.977417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.980231Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.980231Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:09feb1fa431217b4d51bef8ae3528af8c50736dc1e46868cdb1ac61fac749baf","observation_id":"efe29ff9-21e5-41c0-8750-d9f3598b59d9","resolution":{"observed_at":"2026-08-03T03:15:09.980231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.983232Z","title":"Klees, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.983232Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:26915979c86d87a36f25ce75036cc6e77769fde8715179ac188919f25d64294a","observation_id":"93ac4450-3308-4b38-aa0b-72c8c9f44030","resolution":{"observed_at":"2026-08-03T03:15:09.983232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.985951Z","title":"Kvasov, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.985951Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:41a42e90df4e25fe5bf641f232a95bc9f87199756d10cc2a6144fd6f9c03599c","observation_id":"9bfbc5c4-a4c2-4c2d-9143-242c30171f47","resolution":{"observed_at":"2026-08-03T03:15:09.985951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.988381Z","title":"Landen, K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.988381Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d0e5fd2089edf3f811668ab75ab4f466ddc54ec4ae0fbad746c8c139e246d533","observation_id":"50fd35dc-31f6-4a05-9c18-d287b9e89273","resolution":{"observed_at":"2026-08-03T03:15:09.988381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.990821Z","title":"Landis and G","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.990821Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:90dbce9a254438a41050ba23cc57924254f78b79675ffc1d36ec8531076525bf","observation_id":"63909332-5fd1-4e86-a25f-0ec99801f06d","resolution":{"observed_at":"2026-08-03T03:15:09.990821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.993430Z","title":"Le Tolguenec, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.993430Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:bcda47294e848a5cc6f3030d814babce9193c086266250dd04b5de17b0dc3d5f","observation_id":"0d59880a-4cd0-4121-a5f5-c3c7a7aa86e2","resolution":{"observed_at":"2026-08-03T03:15:09.993430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.995739Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.995739Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:a1105bd3233d438b9e9b8789e920a863a3de506ba03226e59a11d3acbb98c3ab","observation_id":"13b8c343-7b53-4224-b476-661a6160b989","resolution":{"observed_at":"2026-08-03T03:15:09.995739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:09.998821Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:09.998821Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:dcc0700c60bbbee24b9a30e865cff23bde785a2b2dc93e888ce87ecf1b49c580","observation_id":"163bdb5b-5330-4c5c-8f4b-84f03e772680","resolution":{"observed_at":"2026-08-03T03:15:09.998821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.001377Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.001377Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:98dabf8ece5db772c07cfe54588bc3f969fbfb6fb6bc304a90cc07262b4f91eb","observation_id":"3f8c22e3-ed8b-4157-9277-0364c1aa7e09","resolution":{"observed_at":"2026-08-03T03:15:10.001377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.004278Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.004278Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:4361306286b4c4c2ef9be43eeb779658916cb9a7d636aa52bb0ca62707e04be0","observation_id":"b7e036e0-e1f2-477d-92bc-78f48574ff2d","resolution":{"observed_at":"2026-08-03T03:15:10.004278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.006789Z","title":"Lopez-Martin, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.006789Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:7fe466220b2f16ddb050891dbe3db3f96af7ae90f542688ef691dc1a2b816dcd","observation_id":"fd98dc55-f369-4fc3-b0b8-821e8affd97c","resolution":{"observed_at":"2026-08-03T03:15:10.006789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.009390Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.009390Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:239c45218107af965a5b0947a304e130f2fdc13c67679c3d922ee050582d3527","observation_id":"533f6006-bc2d-4fa5-be57-4040536b5969","resolution":{"observed_at":"2026-08-03T03:15:10.009390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.011827Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.011827Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:024b7ca5cf0e1353c625fc45d13345f1fb8e70a5fddb39c1f8aa2e71c2ee789a","observation_id":"80ea6da6-5e9f-4549-ad8c-3a97544d8071","resolution":{"observed_at":"2026-08-03T03:15:10.011827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.014268Z","title":"Maeda and M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.014268Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:64a8ea61b996fb785fbbfc37c9e008c3c1bc3cc743f78520916458eeeeca1187","observation_id":"78e4e4b4-d6aa-463d-8111-932f1c90d82a","resolution":{"observed_at":"2026-08-03T03:15:10.014268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04262","last_updated":"2025-03-06T09:46:16Z","snapshot_observed_at":"2026-08-07T17:25:19.644698Z","submitted_at":"2025-03-06T09:46:16Z","title":"Guidelines for Applying RL and MARL in Cybersecurity Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04262","snapshot_observed_at":"2026-08-03T03:15:10.016619Z","title":"Mavroudis, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.016619Z"},"links":{"cited_paper":"/paper/2503.04262","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:650cb7cf31ff54866bb7ffafc22ab45970ca5dd22c6a129304871533ce28cccc","observation_id":"4e85cdea-4499-4c2c-9106-42eea1647fe5","resolution":{"observed_at":"2026-08-03T03:15:10.016619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.019651Z","title":"McFadden, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.019651Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:f6db88cb3d6eabca9ba193fd7a5cdcbeed319e6bf29e3e37257716a939e1b209","observation_id":"604565b2-5d9c-48eb-8bef-d525f02b2ea5","resolution":{"observed_at":"2026-08-03T03:15:10.019651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.022298Z","title":"McFadden, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.022298Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:dd9582551042da8a545b14fa2f9c1ea3aead40e919e7e5f73547c1a97c7d3cad","observation_id":"cb99c67d-c6e4-4655-a385-fdb9db72d5a3","resolution":{"observed_at":"2026-08-03T03:15:10.022298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.025213Z","title":"McFadden, Z","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.025213Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:1b744d49f7caced73dfe1dd373c9a660e87113711506e6bab6f60981e258e5d2","observation_id":"64926738-6233-48f9-a7bb-02fc8c37a9d9","resolution":{"observed_at":"2026-08-03T03:15:10.025213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.027896Z","title":"McFadden, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.027896Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:5a601f3802ba93999bb1b3000a4cb3f94b02ff800cbbbceb7cfaf515a6fc3b8c","observation_id":"9543db87-378c-4914-901f-1be6c661b2a4","resolution":{"observed_at":"2026-08-03T03:15:10.027896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.030583Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.030583Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:62493b5298261372a44caddc1f149b37fdb86948ac3ba0dee5c886b24d7ae615","observation_id":"bc519fd2-d6b0-4a02-b7b3-f8b71ad9fe43","resolution":{"observed_at":"2026-08-03T03:15:10.030583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.033069Z","title":"Mirhoseini, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.033069Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:d890b0f4f0717a13e49dff4721c74f86dc5c06155e5e373dafee492885c69d8e","observation_id":"d0451681-c554-45ae-8676-8945d4f013bb","resolution":{"observed_at":"2026-08-03T03:15:10.033069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.035822Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.035822Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:1e54e495f7d86c72cc6fcd01dc42ddf7e0ff7fae5a1d8e04d301812e83f76210","observation_id":"26611a8e-a274-44e4-acab-daf7203933fd","resolution":{"observed_at":"2026-08-03T03:15:10.035822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-03T03:15:10.039266Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.039266Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:0a9b37097b445d1ea09639d146e13671a197442b316c23b32ba5a87c9c313f73","observation_id":"8c574b0a-088d-4cd2-82db-047394280cf8","resolution":{"observed_at":"2026-08-03T03:15:10.039266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.042701Z","title":"Mohamed and R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.042701Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:44e2377f0f2bf37b1352f47b67ff84978ac5125bd3ee37590cb0d19d28d4532b","observation_id":"46404a93-0be5-443a-a942-39be683e530b","resolution":{"observed_at":"2026-08-03T03:15:10.042701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.045495Z","title":"Moore, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.045495Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:8f47fb034c9f2f94ab401c80efddbabfac93e17db12e2747c92a680113432e18","observation_id":"01633a73-c818-4141-8021-836978c8ec75","resolution":{"observed_at":"2026-08-03T03:15:10.045495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.048370Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.048370Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:99bbd202ed558b5d55e019a302a20236ea76aee2347d1f8d071bd7e75037b2b4","observation_id":"ec6e792f-3697-4fa0-9cf0-8b7ee909d90b","resolution":{"observed_at":"2026-08-03T03:15:10.048370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.051172Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.051172Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:5201439c3f5c0bdfbaf0accccc43084f1e0e43751b291f180510724a48ee8563","observation_id":"9f009ee0-b67a-46ac-9c19-f1d03c13b64e","resolution":{"observed_at":"2026-08-03T03:15:10.051172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T03:15:10.053731Z","title":"Nikishin, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-03T03:15:10.053731Z"},"links":{"citing_paper":"/paper/2602.08690"},"observation_digest":"sha256:89b347fc79c497a2456191fe75d01b30f239845bdd8303b706ce1b01987c838f","observation_id":"28ba3372-47f8-4388-90f8-72602b90d690","resolution":{"observed_at":"2026-08-03T03:15:10.053731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.08690","last_updated":"2026-06-22T11:24:21Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T10:10:44.062711Z","submitted_at":"2026-02-09T14:12:41Z","title":"SoK: The Pitfalls of Deep Reinforcement Learning for Cybersecurity"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":154},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 154 outbound references and 1 inbound Pith citation observation for arXiv:2602.08690."}