{"as_of":"2026-08-14T09:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1fe4b6bb1c4205fd9a09bf0d39b5d2e967c42a50822e62313148825371439744","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:11:10.306423Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:46:41.137112Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T08:11:03.670670Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"cited_work":{"arxiv_id":"2505.22531","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22531","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.22531 (2025)","venue":null,"work_id":"48adfeb1-e564-4d3d-b29d-7b4442c8d7c5","year":2025},"citing_paper":{"arxiv_id":"2604.08805","last_updated":"2026-04-09T22:41:01Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-09T22:41:01Z","title":"Building Better Environments for Autonomous Cyber Defence","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:41.137112Z"},"links":{"cited_paper":"/paper/2505.22531","citing_paper":"/paper/2604.08805"},"observation_digest":"sha256:52e62c10ea3f81e9a1036241252e7f4a3d0022fb58e17cf72c8a74ca80144b47","observation_id":"1274a74a-2935-47b1-b76b-13fc76a360ea","resolution":{"observed_at":"2026-05-11T08:11:03.673188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22531/citation-record","integrity":"/paper/2505.22531/integrity","json":"/paper/2505.22531/citation-record.json","paper":"/paper/2505.22531"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.963616Z","title":"CAGE Challenge 4","venue":null,"work_id":"95b40e8b-b061-4b2c-ba53-feee6215ebf2","year":2024},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:03.959628Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:91adfb4ff6c083703152c2b9213b5457ee8ea9eb74870a32d76629ec0febdeb5","observation_id":"eb188674-4574-4b46-b1a3-6461aac22207","resolution":{"observed_at":"2026-08-07T13:11:45.052112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.801061Z","title":null,"venue":null,"work_id":"20b23ae0-53b6-4bc0-9efe-643799ee61a6","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.065882Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:9bc93bae7615a9589d255d907c2b6bffa1b3c7beb773c010c50aace6611f98bd","observation_id":"ca5c31f3-561e-4997-8d41-df30c13f1f91","resolution":{"observed_at":"2026-08-07T13:11:44.861168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.582913Z","title":null,"venue":null,"work_id":"470237da-20e2-4d87-966e-bfb29ca8f3e5","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.234270Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:be94a42503d057a5bccd620b00e159c08d966a87713d7f2a969885453cd1263a","observation_id":"37a41719-98d3-4b1b-a6b8-1679d79cf709","resolution":{"observed_at":"2026-08-07T13:11:44.678408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:04.339262Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.339262Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:9f4e1595684435038316d6ccb53939d7e6f207d747d87f8b19f0df694a754bbe","observation_id":"4ad2e1db-8835-4a28-b508-3657389eb673","resolution":{"observed_at":"2026-08-07T13:11:04.339262Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10667","last_updated":"2020-02-26T02:24:11Z","snapshot_observed_at":"2026-08-13T21:03:08.324742Z","submitted_at":"2020-02-25T04:59:24Z","title":"CybORG: An Autonomous Cyber Operations Research Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10667","snapshot_observed_at":"2026-08-07T13:11:04.521391Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.521391Z"},"links":{"cited_paper":"/paper/2002.10667","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:26521a76b7f418d7d5ad5bf5ebb0d8606c471963d8e1e312c36ab543a6396e7d","observation_id":"155f4dc7-d75a-4fac-aba9-4cd2600e1f62","resolution":{"observed_at":"2026-08-07T13:11:04.521391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.389227Z","title":null,"venue":null,"work_id":"6f64b4d6-b4c8-4399-a844-5c7935b3b738","year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.687645Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:99fea08c9d8b8d3c70784adc31a31a80f18236a548f9452ae269d2baa6ab165f","observation_id":"fa1e2baf-57da-4b3e-909c-9f2aff945549","resolution":{"observed_at":"2026-08-07T13:11:44.461297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.169602Z","title":null,"venue":null,"work_id":"97f3d067-c7a5-428c-8255-5816acc87008","year":2020},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.837305Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:500a5bf375281566bf5b5157457f3904d7c26a7019b9f8c444026a8c3fff740d","observation_id":"64252b38-c280-4454-989c-4fca2130b636","resolution":{"observed_at":"2026-08-07T13:11:44.269745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:04.994885Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:04.994885Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:877293cedeffccfd528bcb6944168f29eac5be776ffc6524ef35ea5daec9f1c4","observation_id":"771b7a74-741a-4a5a-ac21-074081fa7eb0","resolution":{"observed_at":"2026-08-07T13:11:04.994885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:05.214417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.214417Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:5abbaaa1018be7c15d66eb95a5ea0ae41f47717151e1fc56a40aeeb35fc45c93","observation_id":"aa794833-c096-4ec2-9e03-8c32e6192b47","resolution":{"observed_at":"2026-08-07T13:11:05.214417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.989201Z","title":null,"venue":null,"work_id":"45d0e21f-4303-4dec-b870-7ac02a73e75f","year":2009},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.351502Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:73829f785995c46a76a962c31eea9993513fbc3e48184ad56f95e87b1a8fbfed","observation_id":"494b98b4-a508-411f-b667-f6a1bfff3909","resolution":{"observed_at":"2026-08-07T13:11:44.068848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.790635Z","title":null,"venue":null,"work_id":"1e6d0679-2cd9-4db9-afdf-656388c981ca","year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.518495Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:130ba37cb62ba6087be7943fdb4bc3689c317f47b21124406183cd0f1b0a80ac","observation_id":"49a7c279-2148-411c-823d-f9dd5a0f4c45","resolution":{"observed_at":"2026-08-07T13:11:43.897979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.606050Z","title":null,"venue":null,"work_id":"189c68ac-cbe9-4db1-92fa-85a7ebb35ac3","year":2018},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.675275Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:df410fb5810ec90f247a1d7ee96f350995d9c52a587a5f5d69f0c4494d7a8b01","observation_id":"117f4fab-725a-4c8a-bdcb-e3180f183b49","resolution":{"observed_at":"2026-08-07T13:11:43.709642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-12T20:26:28.956960Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-08-07T13:11:05.772958Z","title":"Bartlett, Ilya Sutskever, and Pieter Abbeel","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.772958Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:2ae9ef1f2426d99fd80864d3e585c6ffcf4869f193c1d45996ae85cf9a4ebac8","observation_id":"9cdde18a-17d1-45b7-a35f-3c37e8c4b9e2","resolution":{"observed_at":"2026-08-07T13:11:05.772958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-08-12T20:12:44.567915Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-07T13:11:05.862730Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:05.862730Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:e9dc66f6caa31e6ac8d4e19fa2137022f7b532cd43e23e863d769f3679c61781","observation_id":"09a3fde1-7fad-4ab0-b7e3-1eb6ab2baf22","resolution":{"observed_at":"2026-08-07T13:11:05.862730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.82852","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:38.482570Z","title":null,"venue":null,"work_id":"f88dcb48-663b-4e6d-952e-1e40666a16d7","year":2017},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.073771Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:92b226b58c3673263a833e929ca831d6258d715d4456447a1a17aa57a75b913f","observation_id":"cd6b751e-120c-4f2d-ae4c-babc680ebf00","resolution":{"observed_at":"2026-08-07T13:11:38.609064Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08438","last_updated":"2019-07-03T20:50:53Z","snapshot_observed_at":"2026-08-01T23:52:19.594276Z","submitted_at":"2019-02-22T11:20:42Z","title":"Online Meta-Learning","version":4},"cited_work":{"arxiv_id":"1902.08438","doi":"10.48550/arxiv.1902.08438","metadata_source":"pith","pith_arxiv_id":"1902.08438","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Online Meta-Learning","venue":"cs.LG","work_id":"6836f478-1b81-4239-80f3-8386eee46453","year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.239540Z"},"links":{"cited_paper":"/paper/1902.08438","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:5307991d62c64eeead481f3ad58a0a2455a1f79258cba4d1f35e2df69c324506","observation_id":"abf7c050-0b9e-4981-9dc8-fbacddea841b","resolution":{"observed_at":"2026-08-07T13:11:10.749504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.422017Z","title":null,"venue":null,"work_id":"f509f959-e19e-4876-86aa-5318916edc87","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.356786Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:fbd2e0ff37e44986f81727c84a43dd7434304027fd38884f13b49248a5e1f460","observation_id":"a28c5d08-cc3b-46cb-b291-a362cc1a37a2","resolution":{"observed_at":"2026-08-07T13:11:43.486516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.169063Z","title":null,"venue":null,"work_id":"332b4c8a-21ce-4105-8a41-10c585e78b89","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.428805Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:f83fb3c249808c1b02fd6bdc09899edece1b2afcc6bb67881417615b4cfca3e5","observation_id":"e976ad2a-b1e6-4c85-a2de-745858616847","resolution":{"observed_at":"2026-08-07T13:11:43.324085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:06.526276Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.526276Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:9f21fd80420b6f421b2cff0722e7cd29877ac39a9541422325869f8c8a2f115e","observation_id":"5bff8c1e-b8ab-4322-b79c-72bea1bceec8","resolution":{"observed_at":"2026-08-07T13:11:06.526276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:42.887991Z","title":null,"venue":null,"work_id":"da095904-c21f-4730-9ffa-1e4a2fc1efb9","year":null},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.602425Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:cd173ff8e875cba3b861c26ecda56a4c69993af35d238e4204a1ae069a39d089","observation_id":"d8d1c3ab-33f8-4b08-9e0a-b535c9e76ef3","resolution":{"observed_at":"2026-08-07T13:11:42.991505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:42.593351Z","title":null,"venue":null,"work_id":"153ebb61-e4dc-4f5f-ae22-b018706fd00f","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.742620Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:1c48ce93567a1c252a2b32f692147b777e19e8a8a4fe7dfbb1ae80c1a3a1899b","observation_id":"1ce18123-f420-4e19-bbe7-322a6f1f215a","resolution":{"observed_at":"2026-08-07T13:11:42.738280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17246","last_updated":"2023-08-18T11:32:44Z","snapshot_observed_at":"2026-08-13T21:02:20.781716Z","submitted_at":"2023-05-26T20:19:09Z","title":"NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios","version":2},"cited_work":{"arxiv_id":"2305.17246","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.17246","snapshot_observed_at":"2026-08-07T13:11:37.921239Z","title":"NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios","venue":"cs.CR","work_id":"0858dc79-c2bd-4d88-bdb3-235ca71583fa","year":2023},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.818592Z"},"links":{"cited_paper":"/paper/2305.17246","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:db241f41c0cf9dc63c5db549b594b8bc7a19c167754d1fd0e297a3e695a890fc","observation_id":"04dce863-f4e0-47d7-8e25-56732d291d4c","resolution":{"observed_at":"2026-08-07T13:11:38.018967Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08212","last_updated":"2021-04-27T20:06:33Z","snapshot_observed_at":"2026-08-13T19:38:35.034727Z","submitted_at":"2021-04-16T16:38:02Z","title":"MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08212","snapshot_observed_at":"2026-08-07T13:11:06.996985Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:06.996985Z"},"links":{"cited_paper":"/paper/2104.08212","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:1c13c0f9d9a00c080ffea2cc1cbecdeded23b51d6d6a7984bbaefdef855bb942","observation_id":"484a4aa4-4444-4160-a4e6-41601d8089a9","resolution":{"observed_at":"2026-08-07T13:11:06.996985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:42.322149Z","title":null,"venue":null,"work_id":"40a6a7a0-b199-4d81-94f8-d20f56ff7e67","year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:07.188429Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:77d8d3ded06684b68f9ba14a5b027bc93505be6c961aef9fa4c9968eb90004fa","observation_id":"1dbf68e6-e570-41c0-8e48-6d6a67025236","resolution":{"observed_at":"2026-08-07T13:11:42.469596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:42.034930Z","title":"El Rami, Adrian Taylor, James Hailing Rao, and Thomas Kunz","venue":null,"work_id":"c23b9cd6-8cc1-472b-b5b8-c9c7b7239a73","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:07.375337Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:9c054394710ea2819d68ec62e0f5ba91aa31cdfc73d5762e7428510101a22305","observation_id":"35bcb4ea-d5d5-43f4-8602-906b6eb917b8","resolution":{"observed_at":"2026-08-07T13:11:42.200387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.03331","last_updated":"2021-09-07T20:52:44Z","snapshot_observed_at":"2026-08-13T18:15:34.654750Z","submitted_at":"2021-09-07T20:52:44Z","title":"CyGIL: A Cyber Gym for Training Autonomous Agents over Emulated Network Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.03331","snapshot_observed_at":"2026-08-07T13:11:07.538210Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:07.538210Z"},"links":{"cited_paper":"/paper/2109.03331","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:a5bd3096afc11379818996caa8e98b5c2d7bd0cf96de16cf0a1ba604269ff7cd","observation_id":"5ef62981-2248-4a30-9c4c-6a93baa40d18","resolution":{"observed_at":"2026-08-07T13:11:07.538210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:41.717342Z","title":null,"venue":null,"work_id":"1e04b662-2fae-4091-8190-046e5889dd0d","year":null},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:07.767521Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:5edf8526d343a7f0bea901b11205493aaf096a28e2bda54571b34098a9610219","observation_id":"9ee5bd42-6aac-4fa3-80da-48f530dfcd76","resolution":{"observed_at":"2026-08-07T13:11:41.864142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:41.240878Z","title":null,"venue":null,"work_id":"4dae6ab7-3afc-4840-af5b-6dfa6eb4182d","year":2023},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.050955Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:75564f7cc3399d4fa641899a8338ecfcfbafba3d281b88f7f57f989dbb3f28c8","observation_id":"d5fdd51a-e0f5-4787-8a9e-26ea35d9444e","resolution":{"observed_at":"2026-08-07T13:11:41.378575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10262","last_updated":"2021-04-20T21:52:51Z","snapshot_observed_at":"2026-08-13T05:06:20.942665Z","submitted_at":"2021-04-20T21:52:51Z","title":"Network Defense is Not a Game","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10262","snapshot_observed_at":"2026-08-07T13:11:08.154209Z","title":"Winder, and Ahmad Ridley","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.154209Z"},"links":{"cited_paper":"/paper/2104.10262","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:d2ac92528eb1d68dcdebe35bd060ce9ddfb761227d0c81746cb83843ab739e62","observation_id":"c5d6bee2-a70f-49cb-9312-6b18b8366101","resolution":{"observed_at":"2026-08-07T13:11:08.154209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11084","last_updated":"2023-04-17T07:52:00Z","snapshot_observed_at":"2026-08-13T12:01:52.400642Z","submitted_at":"2023-04-17T07:52:00Z","title":"Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations","version":1},"cited_work":{"arxiv_id":"2304.11084","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11084","snapshot_observed_at":"2026-08-07T13:11:11.469043Z","title":"Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations","venue":"cs.CR","work_id":"0765d4b3-a77e-4d3b-ac56-b71b39ab3849","year":2023},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.285612Z"},"links":{"cited_paper":"/paper/2304.11084","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:60b4c8f4808471a0ec69b2b475ee92931f793c8073304b9904e1f47ac9382676","observation_id":"7e03e324-70e8-4b77-b832-d0f585236e68","resolution":{"observed_at":"2026-08-07T13:11:37.800628Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:08.422493Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.422493Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:6801b8ea8b036e45d4fd2aa5aeddd8a393042eb3ada1f657691c1a4a1b40e15f","observation_id":"cc5abc89-3466-45d5-b50b-952c470116e2","resolution":{"observed_at":"2026-08-07T13:11:08.422493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.827891Z","title":"2019.Solving Rubik’s Cube with a Robot Hand","venue":null,"work_id":"7b0a86f4-2702-4fdb-991c-702ba16df097","year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.576538Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:13f5f2c5854ea13ded341ca4843390e4461d8b13a5a720bf0c9e3c3b28960d01","observation_id":"3e431207-fb74-45bd-9a93-ec7968261ec7","resolution":{"observed_at":"2026-08-07T13:11:40.974658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.579351Z","title":null,"venue":null,"work_id":"7981feb9-6e7a-4f44-871e-05584110a7ba","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.706185Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:20be00d433d255a0035dd75e0665f54984ce3d03751db2bbbd999f68e7a4b10b","observation_id":"16d4a313-1a4c-4771-b6ab-ce2bd6aa2e6a","resolution":{"observed_at":"2026-08-07T13:11:40.733902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.398712Z","title":null,"venue":null,"work_id":"f65c9bad-2be6-4bb3-bdfe-05dafce48b53","year":2020},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.798976Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:e5dd2aa43b067f75463322a77178b204f8ef5f5d77291ca2917b0e51a66da34b","observation_id":"2e728f4d-9e40-4557-b5be-fddf298058a7","resolution":{"observed_at":"2026-08-07T13:11:40.475148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-09T14:58:04.904559Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-07T13:11:08.934687Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:08.934687Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:746d6f3ad78ca4caa243a95c0dadfe24d0f769a5671e5a1ae4d4f8cda786aae2","observation_id":"7f974e1c-aa56-4a94-9545-65687568ef72","resolution":{"observed_at":"2026-08-07T13:11:08.934687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12931","last_updated":"2021-10-27T20:11:50Z","snapshot_observed_at":"2026-08-10T15:37:20.033035Z","submitted_at":"2021-07-27T16:39:45Z","title":"Autonomous Reinforcement Learning via Subgoal Curricula","version":2},"cited_work":{"arxiv_id":"2107.12931","doi":"10.48550/arxiv.2107.12931","metadata_source":"pith","pith_arxiv_id":"2107.12931","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Autonomous Reinforcement Learning via Subgoal Curricula","venue":"cs.LG","work_id":"aee93fc5-be9c-404e-815c-05717280aeba","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.073435Z"},"links":{"cited_paper":"/paper/2107.12931","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:192d528dede852270ca8a499b304d274f65fb0b5e7e5df7a0dc1a9c2a577f232","observation_id":"f97421df-1b36-4418-a323-fb91d0c8d382","resolution":{"observed_at":"2026-08-07T13:11:10.544736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09118","last_updated":"2021-08-20T11:32:23Z","snapshot_observed_at":"2026-08-13T18:44:41.873396Z","submitted_at":"2021-08-20T11:32:23Z","title":"CybORG: A Gym for the Development of Autonomous Cyber Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.09118","snapshot_observed_at":"2026-08-07T13:11:09.194790Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.194790Z"},"links":{"cited_paper":"/paper/2108.09118","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:8451767ee088d3d2f65ed763078cb347b81ae0430bb5ff0cdbfcec915bcec2ec","observation_id":"af7941a2-14aa-4fc8-8614-d36c12ae5b72","resolution":{"observed_at":"2026-08-07T13:11:09.194790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.201114Z","title":"Strom, Andy Applebaum, Douglas P","venue":null,"work_id":"85bbb1d2-a02b-4230-96d5-2a98e7519cfb","year":2018},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.375089Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:ac9afd5657c17d59b7faa30c8f97de867f7216aaa90cd1d7be815796f5dd4cbb","observation_id":"dc4a094f-599f-454c-ad50-9f94ec89a6ba","resolution":{"observed_at":"2026-08-07T13:11:40.307517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:39.971318Z","title":null,"venue":null,"work_id":"99341e64-8c19-44f1-a36e-2e116a306e63","year":2022},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.518352Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:bede0e7969c8e99e39da45828ab6f8dd6e6d365749f8f5e6207f373daa691705","observation_id":"ecce7483-3e88-4e56-9055-d27d2baf3c36","resolution":{"observed_at":"2026-08-07T13:11:40.084765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:39.745397Z","title":null,"venue":null,"work_id":"aac365e0-2a9f-43ec-87ad-88b7128e5f1b","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.599522Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:acfca370da0d3e31a43b241d80189b93b0321c679512ef665d732220e648d01f","observation_id":"80f8b3a8-92cf-4984-9c4b-2d6a1d60987d","resolution":{"observed_at":"2026-08-07T13:11:39.829546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:39.532263Z","title":null,"venue":null,"work_id":"ab78f1c4-594d-49c4-ae7f-1c0a9cfd5e9d","year":null},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.683738Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:377b95ac8fb615b5c645d047a1cc3b4233afc04699007ea3e11bfa437f23c16a","observation_id":"93a1cf43-62f1-4b62-83de-b3db27f91309","resolution":{"observed_at":"2026-08-07T13:11:39.639609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:39.332751Z","title":null,"venue":null,"work_id":"8b907286-cfbf-4f37-a381-cb952b5ac944","year":null},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.917959Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:d9abdec46ba285542891889bc8132109b18bbbcb6e1157bc329984a38bcef6a6","observation_id":"7b864a18-ad4e-48be-ba6e-bc4e2fc06a75","resolution":{"observed_at":"2026-08-07T13:11:39.424842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.12808","last_updated":"2021-07-31T16:55:19Z","snapshot_observed_at":"2026-08-13T18:39:00.581879Z","submitted_at":"2021-07-27T13:30:07Z","title":"Open-Ended Learning Leads to Generally Capable Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.12808","snapshot_observed_at":"2026-08-07T13:11:09.774147Z","title":"https: //arxiv.org/abs/2107.12808","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:09.774147Z"},"links":{"cited_paper":"/paper/2107.12808","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:a2d44d74a154d02f0dc4d040956465fa78dfb269a264e2e0c45cafde13ff4b3c","observation_id":"30ba1cef-de89-459b-b860-9db539608c03","resolution":{"observed_at":"2026-08-07T13:11:09.774147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:39.148591Z","title":null,"venue":null,"work_id":"91bd12f1-e0b1-45cc-b912-10ea8a040b73","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.214421Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:625dab7ae731b8610c67e2e5456b4b9b3081468de28fafb0ea0571bcf5405946","observation_id":"b927cea4-65c0-4de6-96f9-029f5bac24ce","resolution":{"observed_at":"2026-08-07T13:11:39.241652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06449","last_updated":"2021-09-14T05:28:22Z","snapshot_observed_at":"2026-08-13T18:12:21.200791Z","submitted_at":"2021-09-14T05:28:22Z","title":"Deep hierarchical reinforcement agents for automated penetration testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06449","snapshot_observed_at":"2026-08-07T13:11:10.045952Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.045952Z"},"links":{"cited_paper":"/paper/2109.06449","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:5942b7bea463ac2f68240ce954c1e22a7145d05b6c92622cc1a6585b4eaaab88","observation_id":"c25c7df7-9357-45d6-84db-e4a11fc879fd","resolution":{"observed_at":"2026-08-07T13:11:10.045952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07659","last_updated":"2021-02-16T11:31:07Z","snapshot_observed_at":"2026-08-02T15:17:58.235255Z","submitted_at":"2021-02-15T16:40:02Z","title":"Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems","version":2},"cited_work":{"arxiv_id":"2102.07659","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.07659","snapshot_observed_at":"2026-08-07T13:11:11.040252Z","title":"Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems","venue":"cs.AI","work_id":"5ddebc3e-8a56-4c89-bed2-4e54d6d81a46","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.127855Z"},"links":{"cited_paper":"/paper/2102.07659","citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:131b8a647471e068cbe486b0db58aaacae439078a2bf33b5c712f9ad6d032c9e","observation_id":"a18f1acf-a3cd-434b-acfc-cfdd5f5427ab","resolution":{"observed_at":"2026-08-07T13:11:11.132841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:10.306423Z","title":"i d \" : 1 ,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.306423Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:f90a33ee906275c9380e0e2cc1b9ccf52f28d67c8d04140b98a133985b4bc8bf","observation_id":"f0913a24-84d4-4ea9-9009-f161da487d90","resolution":{"observed_at":"2026-08-07T13:11:10.306423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:41.512592Z","title":null,"venue":null,"work_id":"8a4312fc-377a-4eaf-a4d1-398df1f906f5","year":2021},"citing_paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:07.932407Z"},"links":{"citing_paper":"/paper/2505.22531"},"observation_digest":"sha256:58af916ac49c06a5d095e32d41442ed3aa49c07885114125416836c5d04b9e21","observation_id":"c81d5407-6f68-40df-8529-a60ae9c467e9","resolution":{"observed_at":"2026-08-07T13:11:41.593101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22531","last_updated":"2025-06-13T14:59:23Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:49:05.713316Z","submitted_at":"2025-05-28T16:18:21Z","title":"Training RL Agents for Multi-Objective Network Defense Tasks"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":37,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2505.22531."}