{"as_of":"2026-08-10T10:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:563d3615f8ebc48d5162479af10fb7312d2ff167091b18dca803703c2b85089a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:02:35.466750Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:07:49.656453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"cited_work":{"arxiv_id":"2506.02048","doi":"10.48550/arxiv.2506.02048","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv:2506.02048","venue":"ArXiv.org","work_id":"fa6ff75b-ffdf-40e9-b3b8-c51ca5ff7749","year":2025},"citing_paper":{"arxiv_id":"2602.05523","last_updated":"2026-04-17T13:49:22Z","snapshot_observed_at":"2026-07-06T22:44:42.380489Z","submitted_at":"2026-02-05T10:30:57Z","title":"Capture the Flags: Family-Based Evaluation of Agentic LLMs via Semantics-Preserving Transformations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T07:26:55.823329Z"},"links":{"cited_paper":"/paper/2506.02048","citing_paper":"/paper/2602.05523"},"observation_digest":"sha256:19fa06ab57a7e5b060afe10bebe289b6894f6d54636438934cbad35a37f803d7","observation_id":"b6e5e358-173b-417b-bc16-3c5d10b9eff6","resolution":{"observed_at":"2026-05-16T07:27:31.463153Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"cited_work":{"arxiv_id":"2506.02048","doi":"10.48550/arxiv.2506.02048","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02048","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv:2506.02048","venue":"ArXiv.org","work_id":"fa6ff75b-ffdf-40e9-b3b8-c51ca5ff7749","year":2025},"citing_paper":{"arxiv_id":"2605.28146","last_updated":"2026-05-27T08:29:28Z","snapshot_observed_at":"2026-08-04T10:57:53.122170Z","submitted_at":"2026-05-27T08:29:28Z","title":"Cybersecurity AI (CAI) Dataset","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-29T12:07:49.656453Z"},"links":{"cited_paper":"/paper/2506.02048","citing_paper":"/paper/2605.28146"},"observation_digest":"sha256:591e564f3bca1aa57cd9c38eeb58e6ce9c36edb0192a67281f82d059de53926c","observation_id":"4651da1b-586a-412b-a5cb-8d106f7d7fc5","resolution":{"observed_at":"2026-06-29T12:13:26.833206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02048/citation-record","integrity":"/paper/2506.02048/integrity","json":"/paper/2506.02048/citation-record.json","paper":"/paper/2506.02048"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.388647Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.388647Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d09bcac1c8c46ce8502badc786837bfb98842f58bb8f6a5475c3d54e03290979","observation_id":"fa95b339-a0e1-4a06-9995-5bf3b0899e33","resolution":{"observed_at":"2026-08-07T12:02:35.388647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T12:02:35.391491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.391491Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:16ebc4f808835842773777162af5df35b529c4d6b466028e7ab90161e1f5d397","observation_id":"0a64b9f8-2ce1-48d3-8b79-ff9e7372d2f9","resolution":{"observed_at":"2026-08-07T12:02:35.391491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-08T10:18:09.304124Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08144","snapshot_observed_at":"2026-08-07T12:02:35.394058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.394058Z"},"links":{"cited_paper":"/paper/2404.08144","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:515cf3284184d3b6f9f0d1d1cf2872c6ec367ba09277cc815ab26c0e757e18b1","observation_id":"c849b5b3-9a78-4edd-a3ce-a0d2fa71b1b1","resolution":{"observed_at":"2026-08-07T12:02:35.394058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01637","last_updated":"2025-03-30T00:26:48Z","snapshot_observed_at":"2026-08-08T04:41:33.967516Z","submitted_at":"2024-06-02T16:25:26Z","title":"Teams of LLM Agents can Exploit Zero-Day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01637","snapshot_observed_at":"2026-08-07T12:02:35.396718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.396718Z"},"links":{"cited_paper":"/paper/2406.01637","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:017b78a2222ae882d551496a67c5594ebbf416bcc06e212208c98f07d4b0fbda","observation_id":"3f3342ef-e9b4-4c1d-bcb0-a7af2fb80572","resolution":{"observed_at":"2026-08-07T12:02:35.396718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.703558Z","title":null,"venue":null,"work_id":"6d2babe7-2f5a-4dc5-8fa1-26d07f7607e2","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.399342Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:08bc5f4ea5806e4a6a2eac3da16fed15bf4b5645fc487572c41a94c0c6e77ae9","observation_id":"4d5dc54c-603a-452c-8238-74877666b44e","resolution":{"observed_at":"2026-08-07T12:02:35.706042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01778","last_updated":"2024-12-02T18:28:18Z","snapshot_observed_at":"2026-07-06T20:00:23.632792Z","submitted_at":"2024-12-02T18:28:18Z","title":"HackSynth: LLM Agent and Evaluation Framework for Autonomous Penetration Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01778","snapshot_observed_at":"2026-08-07T12:02:35.401593Z","title":"Muzsai, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.401593Z"},"links":{"cited_paper":"/paper/2412.01778","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:35367cdd22b71fec37b3465b50b54cbebdbd0d2d511567af06498b513a632b3a","observation_id":"b8433a1f-db6f-44a2-973e-4a657cf4068e","resolution":{"observed_at":"2026-08-07T12:02:35.401593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05590","last_updated":"2025-02-18T12:26:33Z","snapshot_observed_at":"2026-07-06T18:27:36.903877Z","submitted_at":"2024-06-08T22:21:42Z","title":"NYU CTF Bench: A Scalable Open-Source Benchmark Dataset for Evaluating LLMs in Offensive Security","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05590","snapshot_observed_at":"2026-08-07T12:02:35.404055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.404055Z"},"links":{"cited_paper":"/paper/2406.05590","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d3041a37728ed291678ed66d94fb5e9ec73cbffc5bcc647110b94c8311eb5810","observation_id":"d163595e-7ebc-4faf-a91d-e25a6264d473","resolution":{"observed_at":"2026-08-07T12:02:35.404055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-08-06T12:22:30.341073Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-08-07T12:02:35.406709Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.406709Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:12f4cbb6de2f238df4fe681895618e8679fdfc2aad8212e13163e9306e7fedcf","observation_id":"bc7718ec-e1a9-48e5-92f1-5b9dca55f357","resolution":{"observed_at":"2026-08-07T12:02:35.406709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.696438Z","title":null,"venue":null,"work_id":"79698576-e836-424a-a718-944af3cff846","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.409028Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:7b9378b6a1e0536a0108a7178d2e9c7f51e62d9dba4d2af0242da686f9f8b0a7","observation_id":"d08c128a-540e-4610-a949-cf42fcb8faf3","resolution":{"observed_at":"2026-08-07T12:02:35.698882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:02:35.411104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.411104Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:ef418fbe092ca65c2572d1f2f0f914ddd45bbd686c56b54076f789e940c4c3ee","observation_id":"e8ed4256-efdb-435a-86d0-97e2ce8f940c","resolution":{"observed_at":"2026-08-07T12:02:35.411104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:02:35.413594Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.413594Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:08da6a6a86c6e9fa7bfacd165c0cc5e3a8938d3c5d811e9c406622d055cb1e3b","observation_id":"c3c486ee-fd75-4eb6-935d-bee858c388fc","resolution":{"observed_at":"2026-08-07T12:02:35.413594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.688201Z","title":"1-8B-Instruct, 2024","venue":null,"work_id":"2211944c-0b88-4cf9-bcb1-c9b0c7040bdb","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.415632Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:fdb3591ce57973329a3dc4d6376259f1f4a5346069030f51b4d5e4459435b9ec","observation_id":"f304b23a-89b7-45dd-8787-438e66921a2f","resolution":{"observed_at":"2026-08-07T12:02:35.691624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10443","last_updated":"2023-08-21T03:30:21Z","snapshot_observed_at":"2026-08-05T16:13:40.630996Z","submitted_at":"2023-08-21T03:30:21Z","title":"Using Large Language Models for Cybersecurity Capture-The-Flag Challenges and Certification Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10443","snapshot_observed_at":"2026-08-07T12:02:35.418518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.418518Z"},"links":{"cited_paper":"/paper/2308.10443","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:06bc329f2c4913922418f8724b35f4b386c79a625c78b59b682f38ab4e53b435","observation_id":"a650f72c-7905-4486-9246-e85a5588b093","resolution":{"observed_at":"2026-08-07T12:02:35.418518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06782","last_updated":"2024-06-02T16:16:49Z","snapshot_observed_at":"2026-08-07T16:46:33.307475Z","submitted_at":"2023-08-13T14:35:50Z","title":"PentestGPT: An LLM-empowered Automatic Penetration Testing Tool","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06782","snapshot_observed_at":"2026-08-07T12:02:35.420795Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.420795Z"},"links":{"cited_paper":"/paper/2308.06782","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:b7060be01ae9662178382bb3815398df1b1b3d4d171f871117f1a833b0b7e134","observation_id":"2ef6cafc-a7e0-428b-af97-083345b4c72b","resolution":{"observed_at":"2026-08-07T12:02:35.420795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.681498Z","title":null,"venue":null,"work_id":"cba3006f-c3f6-429c-8e3c-54d74dddbf74","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.423032Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:b471586e1d9c19b2b6bdff75c0e6ab30277876188781421fc1d6b2f359009962","observation_id":"3e1f2d8c-9178-4981-915e-101501c0aaf9","resolution":{"observed_at":"2026-08-07T12:02:35.683997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.674123Z","title":"URL: https://platform.openai.com/ docs/guides/function-calling, accessed: 2025-05-28","venue":null,"work_id":"57344f68-b42c-4b19-8962-8442dbc077e3","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.424947Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:3ff9a49e9e83bf0a319a2c1003a604b9a7f52d62d00eed5b3b3848ab8de592aa","observation_id":"e4a46e96-a38f-418b-a752-da35882d7223","resolution":{"observed_at":"2026-08-07T12:02:35.676718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.666801Z","title":"URL: https://www.anthropic.com/news/model-context-protocol, accessed: 2025-05-28","venue":null,"work_id":"b1212ab6-ed8d-4c2f-91b3-51ec23c4e03e","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.427300Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:cf1f360b900ddcb1e02fc66b59708211f7dc1dc038be941cf0f4fbfb7403b41d","observation_id":"eb4c0bd1-bc1e-4ee1-be55-24d2cb1cdf17","resolution":{"observed_at":"2026-08-07T12:02:35.669486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23278","last_updated":"2025-10-07T07:13:32Z","snapshot_observed_at":"2026-07-06T21:00:55.979837Z","submitted_at":"2025-03-30T01:58:22Z","title":"Model Context Protocol (MCP): Landscape, Security Threats, and Future Research Directions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23278","snapshot_observed_at":"2026-08-07T12:02:35.429250Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.429250Z"},"links":{"cited_paper":"/paper/2503.23278","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:22b23f18a652f278b99e1ad3605d7464cdf8b3a8450b4350d8543b1dc0ecd141","observation_id":"9cfb5d56-476f-4630-ba35-70a77b042409","resolution":{"observed_at":"2026-08-07T12:02:35.429250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:02:35.431731Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.431731Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d8118a50bb062c2a2d9e6588ca17eb9c467d20cbb5b92a6eaeb725ce3e2cf4dd","observation_id":"df4f9eb9-7625-4771-ab55-3dd08100d03a","resolution":{"observed_at":"2026-08-07T12:02:35.431731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.660117Z","title":"Ouyang, J","venue":null,"work_id":"e76954d7-f6bc-4e5f-9305-06beec1dbda6","year":2022},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.433763Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:58e9001748e11e068d00872d6d99d37af8f64757cddf66381719b5cd598da9d3","observation_id":"04c3d49e-c949-416e-8d5e-38992414135d","resolution":{"observed_at":"2026-08-07T12:02:35.662626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.653582Z","title":"Dettmers, A","venue":null,"work_id":"446bff8d-37fa-4dd0-b43f-b14d2a8a4f49","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.436379Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:b171b4c95c63faed49772a18e440387ef6344d35cc4cd8599996e284eb72aa30","observation_id":"55ebcec7-faf9-4d9a-8be5-7b373e70a166","resolution":{"observed_at":"2026-08-07T12:02:35.655915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09580","last_updated":"2026-05-27T13:44:11Z","snapshot_observed_at":"2026-08-06T17:49:53.061259Z","submitted_at":"2025-07-13T11:11:01Z","title":"AICrypto: Evaluating Cryptography Capabilities of Large Language Models","version":6},"cited_work":{"arxiv_id":"2507.09580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.09580","snapshot_observed_at":"2026-08-07T12:02:35.486883Z","title":"AICrypto: Evaluating Cryptography Capabilities of Large Language Models","venue":"cs.CR","work_id":"f0bd9289-b499-44c8-88ef-ba8785fc1b2e","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.438326Z"},"links":{"cited_paper":"/paper/2507.09580","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:8489cf739c34e8ec464d417713291d5a28db50ce4cf81f0dbbf921f5a163cbcf","observation_id":"6834854a-3dcf-426d-8b4a-4e6f000f5704","resolution":{"observed_at":"2026-08-07T12:02:35.491580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.646601Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"2079bf16-33b5-47db-a82b-a4860e4d9705","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.440456Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:c1ec61f9eb6f446c19c37a66c983a3724c96aa90bf55eb5d3f80035f2211747b","observation_id":"ee495015-8739-4612-8855-2b1eb5c8bb6c","resolution":{"observed_at":"2026-08-07T12:02:35.649128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.639922Z","title":"1-70B-Instruct, 2024","venue":null,"work_id":"aa8e2978-a8cc-4679-b959-a41eb96916cf","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.442544Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:aa12e3625393235c16b78b6fcdcb20a902a6ae5ac2cb2f5fe391a84a9234d999","observation_id":"4ed65a50-80c6-4c5b-8f85-d98d31775c57","resolution":{"observed_at":"2026-08-07T12:02:35.642433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.633762Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"29e6d8b3-0c49-415e-bc16-1571de58078c","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.444652Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:33a731269735e1794218a4bbe49504affd04347e02a08f0b3729b0ddc1079409","observation_id":"3a30f6db-1837-41f3-9126-252c3552c2c8","resolution":{"observed_at":"2026-08-07T12:02:35.636112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.627432Z","title":"Accessed: 2025-05-28","venue":null,"work_id":"a0fbbc60-c830-4d40-b38a-a29c192a05f0","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.446866Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:4945dc32dd8a1d1713eff422341fc5452dd742cf4ab8a0441132bf401efcfe42","observation_id":"8d26589d-bc1c-4525-8a7d-fdaaf84358c1","resolution":{"observed_at":"2026-08-07T12:02:35.629552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.620667Z","title":null,"venue":null,"work_id":"0866327a-9b13-4658-b3c9-d55ea1af9b79","year":2025},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.448948Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:d0b0834c0f5d143b36b46e0fdb740b24b354c4043f4841a2b987a4bee3e08db2","observation_id":"f8c7f1b5-0c0c-4e5d-b517-1dcffd2f5e99","resolution":{"observed_at":"2026-08-07T12:02:35.622828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.614433Z","title":"Schick, J","venue":null,"work_id":"67e1296d-fa2b-4e98-98b5-a61b59670800","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.451190Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:0e8b5e328460fbe2abcacd4cbaa134acd0cb4c8da04058009c47e67cde589aa2","observation_id":"52526601-282f-4b35-9150-d2a2d37060ef","resolution":{"observed_at":"2026-08-07T12:02:35.616563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.608197Z","title":null,"venue":null,"work_id":"635001e0-01c7-4ce1-8ee2-9fe4f44bf072","year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.453240Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:923d246962aeb37d8a1576932d54f1efef3479744608828e98187cdf6a1d7a87","observation_id":"1b7d647e-c5c3-4b68-9580-0b3b88f47113","resolution":{"observed_at":"2026-08-07T12:02:35.610339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.601597Z","title":"Greshake, S","venue":null,"work_id":"a51639b7-cab3-4b71-9d00-cc9a7ee87d16","year":2023},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.455294Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:ecadfc2913845bbb11787791e4d67a4b1061273a2c6ed6fcb899faaaf7773267","observation_id":"13133585-3972-40d7-9026-8958a1a230e3","resolution":{"observed_at":"2026-08-07T12:02:35.603791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.594867Z","title":"</reasoning> tags","venue":null,"work_id":"2683f0dc-4822-40fd-b894-0180884556d8","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.457740Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:6ac356322104da7dcf6622454acfab3feca56ad45d7a7b899086a0731044b85e","observation_id":"301f1fce-1070-456c-a0f0-94cada55ab94","resolution":{"observed_at":"2026-08-07T12:02:35.596857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.588024Z","title":"name\": \"execute_python","venue":null,"work_id":"2661c047-490e-4844-a52f-5e970cd213e5","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.459958Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:f8b03ec525dc8970ed584533d422fb785337aee9975056bb002dfd22105f281d","observation_id":"5e0fcd20-e7db-47ad-b7ea-4909f8751a90","resolution":{"observed_at":"2026-08-07T12:02:35.590219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.581715Z","title":"Wrap the final flag in\\boxed{flag{...}}","venue":null,"work_id":"e2038c47-a630-4fb6-8c22-0266fd049e5a","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.462101Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:470f26ffc2071c988e4b85351877ba55593a5b3066a962471fe307c814d886b1","observation_id":"e17357c6-677a-4135-a702-f7710af053d3","resolution":{"observed_at":"2026-08-07T12:02:35.583773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.574860Z","title":"Only write the boxed flagafter the tool’s reply (role=\"tool\") has appeared","venue":null,"work_id":"8b7699ed-2f9c-4701-a82b-fccb5bb79dbb","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.464584Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:ff9ba818b036a5ffadb37e9d95ab91a7261a13f930d345cbdef3c312fa935e8c","observation_id":"ecd17eef-c375-40ba-b49c-514d6d1ac55f","resolution":{"observed_at":"2026-08-07T12:02:35.577357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:02:35.568113Z","title":"A vailable tools MCP_TOOL_LIST Question: QUESTION","venue":null,"work_id":"0d9945ff-9482-47b4-8530-0f5260ee8512","year":null},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.466750Z"},"links":{"citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:03e0a6bdd12b8423e0573dc83cf95be05c145f13a85dd07ca1e3cb76b77eb8d9","observation_id":"968fe1e8-ea31-402a-95c3-46bf0eb29841","resolution":{"observed_at":"2026-08-07T12:02:35.570547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2506.02048."}