Pith. sign in

Paper Citation Record · LEDGER

Training RL Agents for Multi-Objective Network Defense Tasks

As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2505.22531.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22531 v2

Coverage vector

measured 48 of 48 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:11:10.306423Z

measured 49 of 49 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-05-10T16:46:41.137112Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-11T08:11:03.670670Z

Reference resolution

48 of 48 outbound references displayed

  • verified exact5
  • verified fuzzy4
  • unresolved37
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation eb188674-4574-4b46-b1a3-6461aac22207 · outbound

This paper cites CAGE Challenge 4.

Training RL Agents for Multi-Objective Network Defense Tasks CAGE Challenge 4

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:45.052112Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:03.959628Z digest=sha256:12ce147d363a27e9f6908c6e4075cfce87aa353439328bf3b4b053e58317ee4e

Observation ca5c31f3-561e-4997-8d41-df30c13f1f91 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.861168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:04.065882Z digest=sha256:a6158e66f5b4420b74cfd3693bb161c4f4a71702abedbe47fc5a011927f1944a

Observation 37a41719-98d3-4b1b-a6b8-1679d79cf709 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.678408Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:04.234270Z digest=sha256:03a2e4b1c906225062ad5dda5f8340b0e9394345504ef808df1203c75dce884f

Observation 4ad2e1db-8835-4a28-b508-3657389eb673 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 4

Resolution
malformed identifier
no resolver link, observed 2026-08-07T13:11:04.339262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.339262Z digest=sha256:9f4e1595684435038316d6ccb53939d7e6f207d747d87f8b19f0df694a754bbe

Observation 155f4dc7-d75a-4fac-aba9-4cd2600e1f62 · outbound

This paper cites CybORG: An Autonomous Cyber Operations Research Gym.

Training RL Agents for Multi-Objective Network Defense Tasks CybORG: An Autonomous Cyber Operations Research Gym

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:04.521391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.521391Z digest=sha256:419b0dc47ad6f2a572cabff5cba76aa98efedbd73780aa000817daab0cbcd96e

Observation fa1e2baf-57da-4b3e-909c-9f2aff945549 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.461297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:04.687645Z digest=sha256:22cb8f6cf65e090550ef4c271325f9245a24fef6c7faf42601f79b299db7dff1

Observation 64252b38-c280-4454-989c-4fca2130b636 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.269745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:04.837305Z digest=sha256:9c7e24be7e4501d15a3c17e582c89dcce9cb1e953bb0f002690bf47894781f70

Observation 771b7a74-741a-4a5a-ac21-074081fa7eb0 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:04.994885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:04.994885Z digest=sha256:877293cedeffccfd528bcb6944168f29eac5be776ffc6524ef35ea5daec9f1c4

Observation aa794833-c096-4ec2-9e03-8c32e6192b47 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.214417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.214417Z digest=sha256:5abbaaa1018be7c15d66eb95a5ea0ae41f47717151e1fc56a40aeeb35fc45c93

Observation 494b98b4-a508-411f-b667-f6a1bfff3909 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:44.068848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:05.351502Z digest=sha256:2e52d9e775cfe39c08d0e1f97b6b6dafa0c132643a8695e70199b6a73e565e95

Observation 49a7c279-2148-411c-823d-f9dd5a0f4c45 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.897979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:05.518495Z digest=sha256:5e6646de549942dc9663aaa2671de0d05205c4cb955c09755477ab209b48878c

Observation 117f4fab-725a-4c8a-bdcb-e3180f183b49 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.709642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:05.675275Z digest=sha256:0807b63c0550a13cd6898b609e95c4d3dc32e96e8c2b1ac8de541d6a0015d0bb

Observation 9cdde18a-17d1-45b7-a35f-3c37e8c4b9e2 · outbound

This paper cites RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning.

Training RL Agents for Multi-Objective Network Defense Tasks RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.772958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.772958Z digest=sha256:c1e6d3ece7f62b34b54fcf9a35e0aa761ce1a843383f460c7fca184d7c59590a

Observation 09a3fde1-7fad-4ab0-b7e3-1eb6ab2baf22 · outbound

This paper cites Diversity is All You Need: Learning Skills without a Reward Function.

Training RL Agents for Multi-Objective Network Defense Tasks Diversity is All You Need: Learning Skills without a Reward Function

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:05.862730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:05.862730Z digest=sha256:8becb310ff4df1a7182eb9656b6e70393998d7aaa4c86c6587228a32fe157f86

Observation cd6b751e-120c-4f2d-ae4c-babc680ebf00 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 15

Resolution
metadata mismatch
raw_fallback, observed 2026-08-07T13:11:38.609064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.073771Z digest=sha256:741a8306d43e1391de12b0f30ff77f28d44ec7c8d6885e1e8fea6488d8d679fb

Observation abf7c050-0b9e-4981-9dc8-fbacddea841b · outbound

This paper cites Online Meta-Learning.

Training RL Agents for Multi-Objective Network Defense Tasks Online Meta-Learning

Reference 16

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:10.749504Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.239540Z digest=sha256:887a77ef45839fa25df153050633b1b7a06b2b4947c3f1ad589b25c0846769fd

Observation a28c5d08-cc3b-46cb-b291-a362cc1a37a2 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.486516Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.356786Z digest=sha256:bb00e8a89c3a25367bfb908e03e33cd73471e07b38daa3bf8aaf52dea9afc6e0

Observation e976ad2a-b1e6-4c85-a2de-745858616847 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:43.324085Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.428805Z digest=sha256:91ec47b90664a89b121da8eecaa1e0fb747d524d17f425a55775240ae14bbb2f

Observation 5bff8c1e-b8ab-4322-b79c-72bea1bceec8 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:06.526276Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:06.526276Z digest=sha256:9f21fd80420b6f421b2cff0722e7cd29877ac39a9541422325869f8c8a2f115e

Observation d8d1c3ab-33f8-4b08-9e0a-b535c9e76ef3 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.991505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.602425Z digest=sha256:fb0aaf72b0c0a44778d666a6d382da93eee88e9d7c5da227d226b2bad888cb79

Observation 1ce18123-f420-4e19-bbe7-322a6f1f215a · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.738280Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.742620Z digest=sha256:579f3c73a99ab115635d0b3a1ecfa2b77234dfa69f29402370fe350ebeeba742

Observation 04dce863-f4e0-47d7-8e25-56732d291d4c · outbound

This paper cites NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios.

Training RL Agents for Multi-Objective Network Defense Tasks NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:38.018967Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:06.818592Z digest=sha256:9fa01595c171f67589c782f666f985c180e11877d15c267ed7a2f3aff1fbdc43

Observation 484a4aa4-4444-4160-a4e6-41601d8089a9 · outbound

This paper cites MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale.

Training RL Agents for Multi-Objective Network Defense Tasks MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:06.996985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:06.996985Z digest=sha256:947c8b81bba1784728a297ba6009e92f1fd65a3ee7e03e49643edbf65a0a3bf0

Observation 1dbf68e6-e570-41c0-8e48-6d6a67025236 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:42.469596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:07.188429Z digest=sha256:45c257b7c088f46c439a9222d707c2bdfc209db6b45c0c9cd1cc0b328e93d170

Observation 35bcb4ea-d5d5-43f4-8602-906b6eb917b8 · outbound

This paper cites El Rami, Adrian Taylor, James Hailing Rao, and Thomas Kunz.

Training RL Agents for Multi-Objective Network Defense Tasks El Rami, Adrian Taylor, James Hailing Rao, and Thomas Kunz

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:42.200387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:07.375337Z digest=sha256:acdfeb48a46f04643ec0112763ebb0bf326c431a0f08a2f4f34ed8bc9775fb95

Observation 5ef62981-2248-4a30-9c4c-6a93baa40d18 · outbound

This paper cites CyGIL: A Cyber Gym for Training Autonomous Agents over Emulated Network Systems.

Training RL Agents for Multi-Objective Network Defense Tasks CyGIL: A Cyber Gym for Training Autonomous Agents over Emulated Network Systems

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:07.538210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:07.538210Z digest=sha256:2f0b9a6fc52c62edfa7ce626732fe79c184078c41006248ea0db8c3bee612c08

Observation 9ee5bd42-6aac-4fa3-80da-48f530dfcd76 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.864142Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:07.767521Z digest=sha256:86a34ce20cdeca7a351f9c5a363f9761f3768203f153b2d4e0b1a7c8e065fb3a

Observation d5fdd51a-e0f5-4787-8a9e-26ea35d9444e · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.378575Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:08.050955Z digest=sha256:f03c79ee223055416fb06ad593041e73dd629c67bf41ffdc21e11f58afa4701c

Observation c5d6bee2-a70f-49cb-9312-6b18b8366101 · outbound

This paper cites Network Defense is Not a Game.

Training RL Agents for Multi-Objective Network Defense Tasks Network Defense is Not a Game

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.154209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.154209Z digest=sha256:430c3c2af66411840644d1e7ead18b9ce4c2a189ceb77cc903cb90425e2c128a

Observation 7e03e324-70e8-4b77-b832-d0f585236e68 · outbound

This paper cites Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations.

Training RL Agents for Multi-Objective Network Defense Tasks Training Automated Defense Strategies Using Graph-based Cyber Attack Simulations

Reference 30

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:37.800628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:08.285612Z digest=sha256:1997298401e2c540c7edd23ac394d55514cb24f48bda3a8c4410b2a86f417a0a

Observation cc5abc89-3466-45d5-b50b-952c470116e2 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.422493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.422493Z digest=sha256:6801b8ea8b036e45d4fd2aa5aeddd8a393042eb3ada1f657691c1a4a1b40e15f

Observation 3e431207-fb74-45bd-9a93-ec7968261ec7 · outbound

This paper cites 2019.Solving Rubik’s Cube with a Robot Hand.

Training RL Agents for Multi-Objective Network Defense Tasks 2019.Solving Rubik’s Cube with a Robot Hand

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:40.974658Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:08.576538Z digest=sha256:a13e4238d9e3362e0f4279d58f88c0bfcfa10f18c1e4d627fa82a0bc53100deb

Observation 16d4a313-1a4c-4771-b6ab-ce2bd6aa2e6a · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.733902Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:08.706185Z digest=sha256:6be4e56034551f03ae5c3c11ff4bb0c4aac7ca685bb4b8f689c69b01167fecf3

Observation 2e728f4d-9e40-4557-b5be-fddf298058a7 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.475148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:08.798976Z digest=sha256:ff18545723aa763d2abb452698ff517f6f250820470b3205f63a426330d71b06

Observation 7f974e1c-aa56-4a94-9545-65687568ef72 · outbound

This paper cites Dynamics-Aware Unsupervised Discovery of Skills.

Training RL Agents for Multi-Objective Network Defense Tasks Dynamics-Aware Unsupervised Discovery of Skills

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:08.934687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:08.934687Z digest=sha256:746d6f3ad78ca4caa243a95c0dadfe24d0f769a5671e5a1ae4d4f8cda786aae2

Observation f97421df-1b36-4418-a323-fb91d0c8d382 · outbound

This paper cites Autonomous Reinforcement Learning via Subgoal Curricula.

Training RL Agents for Multi-Objective Network Defense Tasks Autonomous Reinforcement Learning via Subgoal Curricula

Reference 36

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:10.544736Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.073435Z digest=sha256:58e08a02fa573a52371854deef940200b013e40447dea037badc3968380dcd57

Observation af7941a2-14aa-4fc8-8614-d36c12ae5b72 · outbound

This paper cites CybORG: A Gym for the Development of Autonomous Cyber Agents.

Training RL Agents for Multi-Objective Network Defense Tasks CybORG: A Gym for the Development of Autonomous Cyber Agents

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:09.194790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:09.194790Z digest=sha256:00efdee42713b69d9d005e88a094db135a3b9c977d7149614bf59a9a6391dd91

Observation dc4a094f-599f-454c-ad50-9f94ec89a6ba · outbound

This paper cites Strom, Andy Applebaum, Douglas P.

Training RL Agents for Multi-Objective Network Defense Tasks Strom, Andy Applebaum, Douglas P

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:11:40.307517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.375089Z digest=sha256:a6a66d1343fbd98beb8934f756c403540e6581ce1280b2e36970d779376e2044

Observation ecce7483-3e88-4e56-9055-d27d2baf3c36 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:40.084765Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.518352Z digest=sha256:54ff11177ccfd1449e6b318f86e6fdf4a79d21737d4e460b057acb6651dec591

Observation 80f8b3a8-92cf-4984-9c4b-2d6a1d60987d · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.829546Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.599522Z digest=sha256:aa255a1ab0b4a2ba071798ce9e0e2714dc1cad995f5470a132548c0ace580226

Observation 93a1cf43-62f1-4b62-83de-b3db27f91309 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.639609Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.683738Z digest=sha256:00f61d7ec03720d9e28c6ce270c1061f1bdf33124312dda89499b60b0a25086c

Observation 7b864a18-ad4e-48be-ba6e-bc4e2fc06a75 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 42

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.424842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:09.917959Z digest=sha256:502d1a12c3ea5f3ce269e0a619dafcaab1e65e18c26e925065fcc22083c63fdd

Observation 30ba1cef-de89-459b-b860-9db539608c03 · outbound

This paper cites Open-Ended Learning Leads to Generally Capable Agents.

Training RL Agents for Multi-Objective Network Defense Tasks Open-Ended Learning Leads to Generally Capable Agents

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:09.774147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:09.774147Z digest=sha256:f019925f988ffaad3a31a5379e668f7370253d29cc7d52c59d0e24d928ba2da5

Observation b927cea4-65c0-4de6-96f9-029f5bac24ce · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 44

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:39.241652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:10.214421Z digest=sha256:a0f65aded7caee353138ff49d565fa74f8eeabc8033e2c9d84c059309952f6d0

Observation c25c7df7-9357-45d6-84db-e4a11fc879fd · outbound

This paper cites Deep hierarchical reinforcement agents for automated penetration testing.

Training RL Agents for Multi-Objective Network Defense Tasks Deep hierarchical reinforcement agents for automated penetration testing

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:10.045952Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:10.045952Z digest=sha256:5f9c84bfaf249de440ba03fd235e1a23fbf59834e1e9f4f74b5ff90d3bb174e9

Observation a18f1acf-a3cd-434b-acfc-cfdd5f5427ab · outbound

This paper cites Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems.

Training RL Agents for Multi-Objective Network Defense Tasks Diverse Auto-Curriculum is Critical for Successful Real-World Multiagent Learning Systems

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:11:11.132841Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:10.127855Z digest=sha256:aa6d7145adde8a268a0c9b28edd7f5cb278d2348f1622d0fd42d6eb482babb45

Observation f0913a24-84d4-4ea9-9009-f161da487d90 · outbound

This paper cites i d " : 1 ,.

Training RL Agents for Multi-Objective Network Defense Tasks i d " : 1 ,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T13:11:10.306423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:11:10.306423Z digest=sha256:f90a33ee906275c9380e0e2cc1b9ccf52f28d67c8d04140b98a133985b4bc8bf

Observation c81d5407-6f68-40df-8529-a60ae9c467e9 · outbound

This paper cites an unresolved cited work.

Training RL Agents for Multi-Objective Network Defense Tasks Unresolved cited work

Reference 2021

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:11:41.593101Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-07T13:11:07.932407Z digest=sha256:c97b2e5a1da624541eb17eede7282ea50e9464ac989c4e4f719f27c49b7d4ed3

Pith citing papers

Observation 1274a74a-2935-47b1-b76b-13fc76a360ea · inbound

Building Better Environments for Autonomous Cyber Defence cites this paper.

Building Better Environments for Autonomous Cyber Defence Training RL Agents for Multi-Objective Network Defense Tasks

Reference 53

Resolution
verified exact
arxiv_id, observed 2026-05-11T08:11:03.673188Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T16:46:41.137112Z digest=sha256:2efdb0b8de183d5716b05539fa9d6c1fa1137c5da9103e03223fb57354aedbe5