{"as_of":"2026-08-22T12:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a9706f7154fc2d2b112f0a6ed2ab81d711705e7e5bc789fbbb4bef7bc8596cf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:28:58.473598Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:38:33.520795Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-10T16:13:35.751742Z","title":"Autopenbench: Benchmarking generative agents for pen- etration testing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13411","last_updated":"2025-01-23T06:33:05Z","snapshot_observed_at":"2026-08-18T00:58:14.972414Z","submitted_at":"2025-01-23T06:33:05Z","title":"VulnBot: Autonomous Penetration Testing for A Multi-Agent Collaborative Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T16:13:35.751742Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2501.13411"},"observation_digest":"sha256:3820f0e22461e84a0b51ddb2c601efb5ebe2f70cdfcafa17878a943e227d4a6c","observation_id":"ee89ef1e-f6a7-4954-b922-bc437c6b9978","resolution":{"observed_at":"2026-08-10T16:13:35.751742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-08T23:10:10.953295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04227","last_updated":"2025-09-11T12:26:33Z","snapshot_observed_at":"2026-08-18T05:20:05.636040Z","submitted_at":"2025-02-06T17:12:43Z","title":"Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:10:10.953295Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2502.04227"},"observation_digest":"sha256:03813e20d1d527a9f75684a056bedc0bb12bb6a6795f444b2724532d4e390bd9","observation_id":"de35d2ad-a344-45fa-8198-e4ca84011687","resolution":{"observed_at":"2026-08-08T23:10:10.953295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-09T05:32:24.938897Z","title":"Available: https://arxiv.org/abs/2410.03225","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.18474","last_updated":"2025-02-05T14:27:17Z","snapshot_observed_at":"2026-08-13T04:40:04.565039Z","submitted_at":"2025-02-05T14:27:17Z","title":"A Contemporary Survey of Large Language Model Assisted Program Analysis","version":1},"reference_index":161,"source":"pdf_text","source_observed_at":"2026-08-09T05:32:24.938897Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2502.18474"},"observation_digest":"sha256:42bdd122cc662ba4f087e4f03333a89a133f64d7a92295e9f61b7c619434285a","observation_id":"4abde3c0-a8d4-4c57-a7a8-53308416d707","resolution":{"observed_at":"2026-08-09T05:32:24.938897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-15T20:28:58.473598Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12786","last_updated":"2025-05-27T05:00:23Z","snapshot_observed_at":"2026-08-20T02:04:57.449283Z","submitted_at":"2025-05-19T07:19:06Z","title":"Forewarned is Forearmed: A Survey on Large Language Model-based Agents in Autonomous Cyberattacks","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T20:28:58.473598Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2505.12786"},"observation_digest":"sha256:e354127eb8f8c3f4fe9f18bed40636a53dad6523e5892457825dbf20a55e9312","observation_id":"76a70774-8182-42d8-9bdf-c1a675c03734","resolution":{"observed_at":"2026-08-15T20:28:58.473598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-07T00:48:15.439899Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-16T02:27:50.910548Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:15.439899Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:d48b557b9d3cfcc1fc03366d0b0e7f3d4274347c7ba36bab596909c6acf340e9","observation_id":"ff71ded2-2ba4-4491-bc5e-b6dc976527d6","resolution":{"observed_at":"2026-08-07T00:48:15.439899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-06T21:10:04.455902Z","title":"Autopenbench: Benchmarking generative agents for penetration testing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-19T17:05:40.882846Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:04.455902Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:e3b2186c0b80a6760c604cd6fcba886e666391aa56a41e22b7794a4db026948d","observation_id":"4d7d9d3d-5ce4-418b-a742-22dd271fc41d","resolution":{"observed_at":"2026-08-06T21:10:04.455902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2509.06921","last_updated":"2026-04-15T05:15:58Z","snapshot_observed_at":"2026-08-11T16:57:51.459332Z","submitted_at":"2025-09-08T17:33:59Z","title":"Neuro-Symbolic AI for Cybersecurity: State of the Art, Challenges, and Opportunities","version":2},"reference_index":174,"source":"pdf_text","source_observed_at":"2026-05-18T18:04:09.528381Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2509.06921"},"observation_digest":"sha256:36b4f41da383709d937b815cee4cd052e347c8c5283b7b5e81a0590148bfa0b6","observation_id":"27bacd1b-08dd-410b-a165-3744a2b61ff2","resolution":{"observed_at":"2026-05-18T18:06:42.909055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-04T00:09:33.496022Z","title":"AutoPenBench: Bench- marking Generative Agents for Penetration Testing, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.02780","last_updated":"2026-02-23T13:17:25Z","snapshot_observed_at":"2026-08-15T00:24:37.042566Z","submitted_at":"2025-11-04T18:03:12Z","title":"PoCo: Agentic Proof-of-Concept Exploit Generation for Smart Contracts","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T00:09:33.496022Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2511.02780"},"observation_digest":"sha256:998281c42b5a976e287d6ff8edb8b75c92043553ab8adb7377982182c200f961","observation_id":"d76c0297-a11c-4260-9d24-07155462fd0b","resolution":{"observed_at":"2026-08-04T00:09:33.496022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2512.22753","last_updated":"2026-04-22T21:48:07Z","snapshot_observed_at":"2026-08-08T22:14:34.218223Z","submitted_at":"2025-12-28T02:55:49Z","title":"From Rookie to Expert: Manipulating LLMs for Automated Vulnerability Exploitation in Enterprise Software","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T20:02:47.746439Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2512.22753"},"observation_digest":"sha256:6596a2c71c59b8e61688d6590003ece05752ac65e37f058524148cc8f35878c4","observation_id":"ccc1f7da-0c8b-46ed-82fe-805fde92620c","resolution":{"observed_at":"2026-05-16T20:03:22.151429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.06486","last_updated":"2026-05-07T16:07:41Z","snapshot_observed_at":"2026-08-02T21:44:55.115745Z","submitted_at":"2026-05-07T16:07:41Z","title":"Autonomous Adversary: Red-Teaming in the age of LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:09:58.566171Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.06486"},"observation_digest":"sha256:c686feab65dfbf24a1d237bd9fa86596759080d94e58e201307dd9bed3f26d36","observation_id":"a0829395-8fbf-40f8-b2ff-564d4ff23ae3","resolution":{"observed_at":"2026-05-11T20:26:10.541154Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.10834","last_updated":"2026-07-28T07:30:21Z","snapshot_observed_at":"2026-08-14T09:22:43.918837Z","submitted_at":"2026-05-11T16:50:00Z","title":"From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:34:55.538935Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.10834"},"observation_digest":"sha256:e776866b83f43c63a99b7b703d25b96c5e7c8a07124e429875fdf8fc6fa09aba","observation_id":"7f0784d0-b838-488b-92e8-25ab5b550474","resolution":{"observed_at":"2026-05-12T07:16:27.683047Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-02T14:22:24.431295Z","title":"Siracusano, and Roberto Bifulco","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.10834","last_updated":"2026-07-28T07:30:21Z","snapshot_observed_at":"2026-08-14T09:22:43.918837Z","submitted_at":"2026-05-11T16:50:00Z","title":"From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T14:22:24.431295Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.10834"},"observation_digest":"sha256:df27c57dc090ec2402f8100a8d93bb1d0c081c1fb64f8d37c4e5a409e9cf1e97","observation_id":"9710babd-2c8b-4b92-8776-7d7167ff2f8c","resolution":{"observed_at":"2026-08-02T14:22:24.431295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.26195","last_updated":"2026-06-16T16:19:26Z","snapshot_observed_at":"2026-08-02T06:03:12.995535Z","submitted_at":"2026-05-25T16:26:59Z","title":"CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T21:19:59.005348Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.26195"},"observation_digest":"sha256:c208a829b8e084a5fc025b291dfee25de509da6a2e084114a9ec3b19dec27521","observation_id":"6b1e73b4-ee16-48fd-86f7-6f2e67d87f44","resolution":{"observed_at":"2026-06-29T21:23:59.018250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.30096","last_updated":"2026-05-28T15:39:43Z","snapshot_observed_at":"2026-08-14T08:49:05.889486Z","submitted_at":"2026-05-28T15:39:43Z","title":"How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T06:53:48.841077Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.30096"},"observation_digest":"sha256:95bd623c595c96946af264576ac351be5cb11d2c2c6a68ec4f1049763c68e7d6","observation_id":"ba9e09b6-a8cc-4093-ad41-4631de23ceca","resolution":{"observed_at":"2026-06-29T14:13:30.524834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2606.13079","last_updated":"2026-06-29T13:15:12Z","snapshot_observed_at":"2026-08-13T01:36:54.597641Z","submitted_at":"2026-06-11T09:02:14Z","title":"The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T06:25:17.298114Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2606.13079"},"observation_digest":"sha256:bdbbeb74322973ba58773d2f92260dffa82591475cc5c6e4593e18b8e4a76726","observation_id":"e90b2f68-dd9b-43ea-924c-728df9a05bfa","resolution":{"observed_at":"2026-07-03T15:38:33.522197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2606.13079","last_updated":"2026-06-29T13:15:12Z","snapshot_observed_at":"2026-08-13T01:36:54.597641Z","submitted_at":"2026-06-11T09:02:14Z","title":"The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T11:27:22.436981Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2606.13079"},"observation_digest":"sha256:13954c633d6c1c07007e902f86d812320b8bdb0a10442595ab2e6055ac28c578","observation_id":"f5fb2b92-04b1-4909-b1c4-7251da9723c6","resolution":{"observed_at":"2026-06-30T11:34:38.131562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03225/citation-record","integrity":"/paper/2410.03225/integrity","json":"/paper/2410.03225/citation-record.json","paper":"/paper/2410.03225"},"outbound":[],"paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T13:12:40.612412Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2410.03225."}