Pith. sign in

Paper Citation Record · LEDGER

Training RL Agents for Multi-Objective Network Defense Tasks

As of 20 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2505.22531.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22531 v2

Coverage vector

measured 48 of 48 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:11:10.306423Z

measured 49 of 49 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-10T16:46:41.137112Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-11T08:11:03.670670Z

Reference resolution

48 of 48 outbound references displayed

  • verified exact5
  • verified fuzzy4
  • unresolved37
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation eb188674-4574-4b46-b1a3-6461aac22207 · outbound

This paper cites CAGE Challenge 4.

Training RL Agents for Multi-Objective Network Defense Tasks CAGE Challenge 4

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:45.052112Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:03.959628Z digest=sha256:2476464caea831b4277ad1d11e811cd412bcf9d06211c0e9e62581c8b1946942

Observation ca5c31f3-561e-4997-8d41-df30c13f1f91 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.861168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:04.065882Z digest=sha256:f7d42a281019ed329a7a51622bb18abcc2cdbf236cf784472f4dff0251484101

Observation 37a41719-98d3-4b1b-a6b8-1679d79cf709 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.678408Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:04.234270Z digest=sha256:24cf9068fa0644018848a74dcad3802da077d8f7c2a78e59ecd6988a06b6ecba

Observation 4ad2e1db-8835-4a28-b508-3657389eb673 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 4

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:11:04.339262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.339262Z digest=sha256:3a3865e9391e73d8d079c5fa9d37d983a1ca501cf1eba241cac6e3aae69eff91

Observation 155f4dc7-d75a-4fac-aba9-4cd2600e1f62 · outbound

This paper cites CybORG: An Autonomous Cyber Operations Research Gym.

Training RL Agents for Multi-Objective Network Defense Tasks CybORG: An Autonomous Cyber Operations Research Gym

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:04.521391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.521391Z digest=sha256:ce12ac826c115a37af7e36ad2bc3faf05cce0689b802c36da0080dd83a7976e6

Observation fa1e2baf-57da-4b3e-909c-9f2aff945549 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.461297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:04.687645Z digest=sha256:b7d9a9e04f821c27e3df507fe6c8217e570cd81ebeee6a815f3a54dfdd16edf7

Observation 64252b38-c280-4454-989c-4fca2130b636 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.269745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:04.837305Z digest=sha256:7511edb2cf839d3c7138808d35f02a61c97210ee8c58c415e96a601544da503a

Observation 771b7a74-741a-4a5a-ac21-074081fa7eb0 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:04.994885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.994885Z digest=sha256:75207f0f4512d426f23f3db42caa726e5b5dbd225bb9f75d6a23424cc46fb5a5

Observation aa794833-c096-4ec2-9e03-8c32e6192b47 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.214417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.214417Z digest=sha256:518f1c11281c32600f20ecf3d612d7f507dd1c533389e2b6cd01e57759ac4a12

Observation 494b98b4-a508-411f-b667-f6a1bfff3909 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.068848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:05.351502Z digest=sha256:fd85396205bc793829fcc0d9aa0a0451df7115709972da04444428f66869e389

Observation 49a7c279-2148-411c-823d-f9dd5a0f4c45 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.897979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:05.518495Z digest=sha256:6c9218ddd43bbbb46cb9c5958da817a21ae7820e8323fa5df8c0685eb64c69d0

Observation 117f4fab-725a-4c8a-bdcb-e3180f183b49 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.709642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:05.675275Z digest=sha256:c9cb058ed947f56c580650b6fd8ce2566278790115ddbc4f35a316a3e68b1ff2

Observation 9cdde18a-17d1-45b7-a35f-3c37e8c4b9e2 · outbound

This paper cites RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning.

Training RL Agents for Multi-Objective Network Defense Tasks RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.772958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.772958Z digest=sha256:bff7cea34ac7eaa185a5b357d69dbe11d98f8731bb659090fa051d17c6b50e6a

Observation 09a3fde1-7fad-4ab0-b7e3-1eb6ab2baf22 · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Training RL Agents for Multi-Objective Network Defense Tasks Diversity is All You Need: Learning Skills without a Reward Function

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.862730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.862730Z digest=sha256:6dcaf9c504fab606b3fb0c88bde2f43be7ce2124f8e948ee7f49f497d25ced40

Observation cd6b751e-120c-4f2d-ae4c-babc680ebf00 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 15

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T13:11:38.609064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.073771Z digest=sha256:987839cefec9942365a08aab4f74abce93a24cd57aaea44266ae8785021ff090

Observation abf7c050-0b9e-4981-9dc8-fbacddea841b · outbound

This paper cites Online Meta-Learning.

Training RL Agents for Multi-Objective Network Defense Tasks Online Meta-Learning

Reference 16

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:10.749504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.239540Z digest=sha256:f773a287589a3a8ac606df3942d1a7ccfcfb691138311881c1c0360f800b26c9

Observation a28c5d08-cc3b-46cb-b291-a362cc1a37a2 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.486516Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.356786Z digest=sha256:11505210d5c163569b71187298d449afaf16f8822779cf6d9198ddbedae0f387

Observation e976ad2a-b1e6-4c85-a2de-745858616847 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.324085Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.428805Z digest=sha256:db9fae4c5c9eb7aa56bd52c73be499122916054b34f958574f42d2c69622022b

Observation 5bff8c1e-b8ab-4322-b79c-72bea1bceec8 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:06.526276Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:06.526276Z digest=sha256:51ff7d72e3a5a0483b902d45fc7d3cee2056227121d4cb6ad885bd22f6b98106

Observation d8d1c3ab-33f8-4b08-9e0a-b535c9e76ef3 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.991505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.602425Z digest=sha256:2733bde9c99a7f1f012b49abc4259e267fceff72f07985c9bb394678a1e29b70

Observation 1ce18123-f420-4e19-bbe7-322a6f1f215a · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.738280Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.742620Z digest=sha256:cdc00b6e18625a321a972b79fc06c35e5379798626b341442ba75c6dab542395

Observation 04dce863-f4e0-47d7-8e25-56732d291d4c · outbound

This paper cites NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios.

Training RL Agents for Multi-Objective Network Defense Tasks NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:38.018967Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:06.818592Z digest=sha256:cd6ff95e33b295e2495be21ab1e61286ae735a8f64ed654b93f7945f0a0d7427

Observation 484a4aa4-4444-4160-a4e6-41601d8089a9 · outbound

This paper cites MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale.

Training RL Agents for Multi-Objective Network Defense Tasks MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:06.996985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:06.996985Z digest=sha256:c3fcf4692a92946689b30be388aef675a4ad995883da05f384b8bf1c5863a007

Observation 1dbf68e6-e570-41c0-8e48-6d6a67025236 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.469596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:07.188429Z digest=sha256:e8079306ee180ca9e058ac208c411e29f42ca97d29d12a26aac282f225770851

Observation 35bcb4ea-d5d5-43f4-8602-906b6eb917b8 · outbound

This paper cites El Rami, Adrian Taylor, James Hailing Rao, and Thomas Kunz.

Training RL Agents for Multi-Objective Network Defense Tasks El Rami, Adrian Taylor, James Hailing Rao, and Thomas Kunz

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:42.200387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:07.375337Z digest=sha256:0ae4df4b7bda5059e252d0b703a2059f737f197f67f619c58215b01aebbe5e9b

Observation 5ef62981-2248-4a30-9c4c-6a93baa40d18 · outbound

This paper cites CyGIL: A Cyber Gym for Training Autonomous Agents over Emulated Network Systems.

Training RL Agents for Multi-Objective Network Defense Tasks CyGIL: A Cyber Gym for Training Autonomous Agents over Emulated Network Systems

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:07.538210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:07.538210Z digest=sha256:2e08fe481fdf515af0236c1f467def1fa165c98db2c2e2491612e91429e8119a

Observation 9ee5bd42-6aac-4fa3-80da-48f530dfcd76 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.864142Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:07.767521Z digest=sha256:3c846af848ef17dbf84cbc0be3262d7e488acf38e19d43449018285c1aab43c7

Observation d5fdd51a-e0f5-4787-8a9e-26ea35d9444e · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.378575Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:08.050955Z digest=sha256:4e1b5904072935511be877bb5c52e011a54a0a5cb5c368f90ca7da0920d153c2

Observation c5d6bee2-a70f-49cb-9312-6b18b8366101 · outbound

This paper cites Network Defense is Not a Game.

Training RL Agents for Multi-Objective Network Defense Tasks Network Defense is Not a Game

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.154209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.154209Z digest=sha256:f7821082551dedebcb8298712e8bf5e5cf37c13e72aca65f04ea27ce4038ff4f

Observation 7e03e324-70e8-4b77-b832-d0f585236e68 · outbound

This paper cites Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations.

Training RL Agents for Multi-Objective Network Defense Tasks Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations

Reference 30

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:37.800628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:08.285612Z digest=sha256:af45772a7699ad37bf0ac4dc021236e899227966b6f1502d262fdbc54582352b

Observation cc5abc89-3466-45d5-b50b-952c470116e2 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.422493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.422493Z digest=sha256:386be12a37b48e2ef70f1e3ff4a499d15bb901814abaf067ab754a2150f36c31

Observation 3e431207-fb74-45bd-9a93-ec7968261ec7 · outbound

This paper cites 2019.Solving Rubik’s Cube with a Robot Hand.

Training RL Agents for Multi-Objective Network Defense Tasks 2019.Solving Rubik’s Cube with a Robot Hand

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:40.974658Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:08.576538Z digest=sha256:b2b585884fa1f5f20e630e10963fe2f2b0f78b4bcaa3f3d9583860f38c7bbc42

Observation 16d4a313-1a4c-4771-b6ab-ce2bd6aa2e6a · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.733902Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:08.706185Z digest=sha256:ccdf45f660c60bb0d43b6935318910a7ac9e2b5e1b70d4a97095d22c8489c6fd

Observation 2e728f4d-9e40-4557-b5be-fddf298058a7 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.475148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:08.798976Z digest=sha256:1379b67f656f6a4c3c7e6819a4887845935aaa1b1f38024ce13980618d6fee83

Observation 7f974e1c-aa56-4a94-9545-65687568ef72 · outbound

This paper cites Dynamics-Aware Unsupervised Discovery of Skills.

Training RL Agents for Multi-Objective Network Defense Tasks Dynamics-Aware Unsupervised Discovery of Skills

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.934687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.934687Z digest=sha256:c975571e6b883720284a60c753fc4dfb5d494c9b2e9ea61e2c861c492db51bb7

Observation f97421df-1b36-4418-a323-fb91d0c8d382 · outbound

This paper cites Autonomous Reinforcement Learning via Subgoal Curricula.

Training RL Agents for Multi-Objective Network Defense Tasks Autonomous Reinforcement Learning via Subgoal Curricula

Reference 36

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:10.544736Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.073435Z digest=sha256:316dccd38450c570ecf917e3efe290214c2ef1c323863328b254af2b007169c4

Observation af7941a2-14aa-4fc8-8614-d36c12ae5b72 · outbound

This paper cites CybORG: A Gym for the Development of Autonomous Cyber Agents.

Training RL Agents for Multi-Objective Network Defense Tasks CybORG: A Gym for the Development of Autonomous Cyber Agents

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:09.194790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:09.194790Z digest=sha256:04e60b2fcedc06c5cb1e0a5e8ef89f50871ea937c70839acd88ec2ed5da115ae

Observation dc4a094f-599f-454c-ad50-9f94ec89a6ba · outbound

This paper cites Strom, Andy Applebaum, Douglas P.

Training RL Agents for Multi-Objective Network Defense Tasks Strom, Andy Applebaum, Douglas P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:40.307517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.375089Z digest=sha256:57f1ee98dc8c8985f63bdcc0afa1cb332f82e6cbd048e6aada7bf4f524a00d0a

Observation ecce7483-3e88-4e56-9055-d27d2baf3c36 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.084765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.518352Z digest=sha256:5e8d6cb37aa11ff6d53089a0718f27a69c9be9b159152764226bd5560ba2ff26

Observation 80f8b3a8-92cf-4984-9c4b-2d6a1d60987d · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.829546Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.599522Z digest=sha256:69ac3da7112d10e51030b609690d650e7f29060ec6d52d9ea8fc179e92cd24f8

Observation 93a1cf43-62f1-4b62-83de-b3db27f91309 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.639609Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.683738Z digest=sha256:ce1b8be795acbe8c6761180cbce82a19725a20e26d03c71ffe973d40181c38f4

Observation 7b864a18-ad4e-48be-ba6e-bc4e2fc06a75 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.424842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:09.917959Z digest=sha256:985f7a7bbf09ac949a9286099a4eb2553d815eab65f1c805d229c2faa683c8b8

Observation 30ba1cef-de89-459b-b860-9db539608c03 · outbound

This paper cites Open-Ended Learning Leads to Generally Capable Agents.

Training RL Agents for Multi-Objective Network Defense Tasks Open-Ended Learning Leads to Generally Capable Agents

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:09.774147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:09.774147Z digest=sha256:74c455dffeb8214b24daab54caac796e9d198c9bc3a5dc6c62469c73b0a1c7e1

Observation b927cea4-65c0-4de6-96f9-029f5bac24ce · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 44

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.241652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:10.214421Z digest=sha256:b2ac04c8f47beb9369069e67b7090c068aed252a11170c1ffa2443031b025c4b

Observation c25c7df7-9357-45d6-84db-e4a11fc879fd · outbound

This paper cites Deep hierarchical reinforcement agents for automated penetration testing.

Training RL Agents for Multi-Objective Network Defense Tasks Deep hierarchical reinforcement agents for automated penetration testing

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:10.045952Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:10.045952Z digest=sha256:c7ec4934cb7693da751c039553c6c7d4d5d1001d4b13c9128ead8a4829f0bafe

Observation a18f1acf-a3cd-434b-acfc-cfdd5f5427ab · outbound

This paper cites Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems.

Training RL Agents for Multi-Objective Network Defense Tasks Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:11.132841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:10.127855Z digest=sha256:8e19303ec9b23e30bce66ae3d95a95ef3eaf65e6073e5f32518ca69ef306f798

Observation f0913a24-84d4-4ea9-9009-f161da487d90 · outbound

This paper cites i d " : 1 ,.

Training RL Agents for Multi-Objective Network Defense Tasks i d " : 1 ,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:10.306423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:10.306423Z digest=sha256:19d50fb4c9a06f58bd328f10ecbbbacda4f17d6aa8898804bcae7f4bf58b07cd

Observation c81d5407-6f68-40df-8529-a60ae9c467e9 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 2021

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.593101Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-07T13:11:07.932407Z digest=sha256:e772d56c8cd029fec84f72815ba28bbdb92ed14c02c6e6e78bc026999c104d20

Pith citing papers

Observation 1274a74a-2935-47b1-b76b-13fc76a360ea · inbound

Building Better Environments for Autonomous Cyber Defence cites this paper.

Building Better Environments for Autonomous Cyber Defence Training RL Agents for Multi-Objective Network Defense Tasks

Reference 53

Resolution
verified exact
arxiv_id, observed 2026-05-11T08:11:03.673188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-10T16:46:41.137112Z digest=sha256:f8be38eb895ee7d83a45ff57a243c0d5b41e956446e99a0cb53ef4d06cb23095