{"as_of":"2026-08-09T22:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:789ffba414206bb11e88c4652dae4a06b8c4e21ea85539db72ad86fddd43a34f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":47,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:04:33.411892Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":10,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2501.19202","last_updated":"2026-04-20T06:27:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-31T15:12:20Z","title":"Improving LLM Unlearning Robustness via Random Perturbations","version":6},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T04:41:47.910423Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2501.19202"},"observation_digest":"sha256:b17d9c9dbbaf80aee9d614e603b336d23f12901e0d3b98a8336cdc86df42f839","observation_id":"b7ef891b-0bd7-4221-834b-c61ee4d21ce9","resolution":{"observed_at":"2026-05-23T04:42:33.401548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-09T22:04:33.411892Z","title":"Llm agents can autonomously hack websites, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00072","last_updated":"2025-01-31T05:33:48Z","snapshot_observed_at":"2026-08-09T21:59:08.230829Z","submitted_at":"2025-01-31T05:33:48Z","title":"LLM Cyber Evaluations Don't Capture Real-World Risk","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T22:04:33.411892Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2502.00072"},"observation_digest":"sha256:8e45cdad11d20b28b65eec1222829ba5c73fc8f683290097164c0a3a34c0c290","observation_id":"c15c0154-c66e-497c-a7a7-88b441c96339","resolution":{"observed_at":"2026-08-09T22:04:33.411892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-09T19:14:53.267105Z","title":"1 Jack Foster, Stefan Schoepf, and Alexandra Brintrup","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00406","last_updated":"2025-07-08T15:49:01Z","snapshot_observed_at":"2026-08-09T19:05:49.739014Z","submitted_at":"2025-02-01T11:45:44Z","title":"Agents Are All You Need for LLM Unlearning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T19:14:53.267105Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2502.00406"},"observation_digest":"sha256:c00622d6ee24a2e9519486a9c86c0eb39be9da6aba0bee8867b2fb8d00686b7a","observation_id":"2274bd20-2e82-44ec-97e7-f49a15c8fae4","resolution":{"observed_at":"2026-08-09T19:14:53.267105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-09T14:48:35.109656Z","title":"Llm agents can autonomously hack websites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01635","last_updated":"2025-02-03T18:59:13Z","snapshot_observed_at":"2026-08-09T18:10:42.454039Z","submitted_at":"2025-02-03T18:59:13Z","title":"The AI Agent Index","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T14:48:35.109656Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2502.01635"},"observation_digest":"sha256:aa85962499cf29998fead1c79d5002eecb70b0709fbf90dff3d9aae7cb8ccb23","observation_id":"5b854797-e88a-48d8-8ddf-e13f1064349e","resolution":{"observed_at":"2026-08-09T14:48:35.109656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-08T23:10:10.946420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04227","last_updated":"2025-09-11T12:26:33Z","snapshot_observed_at":"2026-08-08T23:03:11.306261Z","submitted_at":"2025-02-06T17:12:43Z","title":"Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T23:10:10.946420Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2502.04227"},"observation_digest":"sha256:93224281c34fcf901fe39a8d7ecf154b6e97dd859a99d9f00fbdfe29f57b5a3c","observation_id":"be666ad5-ca06-40b7-89e3-d057dfd3e07d","resolution":{"observed_at":"2026-08-08T23:10:10.946420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-08T14:48:44.420580Z","title":"Bindu, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06656","last_updated":"2025-02-19T16:05:47Z","snapshot_observed_at":"2026-08-09T07:08:16.327947Z","submitted_at":"2025-02-10T16:47:00Z","title":"A Frontier AI Risk Management Framework: Bridging the Gap Between Current AI Practices and Established Risk Management","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T14:48:44.420580Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2502.06656"},"observation_digest":"sha256:43b07b85193aa75e174e6e5f4fac56d99074202c674b455a5b89b0d23c489254","observation_id":"4ca086a0-ba7a-4e11-a3c6-9520382e4f8b","resolution":{"observed_at":"2026-08-08T14:48:44.420580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T15:42:40.760266Z","title":"LLM agents can autonomously hack websites.CoRR, abs/2402.06664, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14148","last_updated":"2025-05-20T09:55:31Z","snapshot_observed_at":"2026-08-09T08:28:24.979628Z","submitted_at":"2025-05-20T09:55:31Z","title":"MM-Agent: LLM as Agents for Real-world Mathematical Modeling Problem","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:40.760266Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2505.14148"},"observation_digest":"sha256:f4223a026dd56c8f741b626ad50acb0d61d61858a5a39313f4a3a5678a2fc700","observation_id":"abd2a32c-ed1a-4872-afd0-03f164ed177d","resolution":{"observed_at":"2026-08-07T15:42:40.760266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T14:01:00.386482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20186","last_updated":"2025-05-26T16:29:21Z","snapshot_observed_at":"2026-08-09T15:29:38.974130Z","submitted_at":"2025-05-26T16:29:21Z","title":"Eradicating the Unseen: Detecting, Exploiting, and Remediating a Path Traversal Vulnerability across GitHub","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:00.386482Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2505.20186"},"observation_digest":"sha256:d3fb8b0ac0f6229b916ac9a3fd28bafeda5154b371147ab01681adcb1a947e64","observation_id":"59924175-85ee-4fe5-b346-6e0fab36afca","resolution":{"observed_at":"2026-08-07T14:01:00.386482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T12:42:12.460789Z","title":"LLM agents can autonomously hack websites.arXiv preprint arXiv:2402.06664, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24019","last_updated":"2025-05-29T21:39:08Z","snapshot_observed_at":"2026-08-07T20:58:14.169872Z","submitted_at":"2025-05-29T21:39:08Z","title":"LLM Agents Should Employ Security Principles","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:12.460789Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2505.24019"},"observation_digest":"sha256:d23864e11be0b5b40f9c18db097f89ad0f71491b46ff55ba1a2182c82019eda1","observation_id":"daed623c-b688-44db-a438-1e84c1d74c33","resolution":{"observed_at":"2026-08-07T12:42:12.460789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T12:02:35.391491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02048","last_updated":"2025-08-17T22:28:50Z","snapshot_observed_at":"2026-08-07T16:47:30.118976Z","submitted_at":"2025-06-01T01:59:52Z","title":"Improving LLM Agents with Reinforcement Learning on Cryptographic CTF Challenges","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:35.391491Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2506.02048"},"observation_digest":"sha256:16ebc4f808835842773777162af5df35b529c4d6b466028e7ab90161e1f5d397","observation_id":"0a64b9f8-2ce1-48d3-8b79-ff9e7372d2f9","resolution":{"observed_at":"2026-08-07T12:02:35.391491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-07T00:34:59.444740Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13434","last_updated":"2025-06-16T12:52:19Z","snapshot_observed_at":"2026-08-09T06:40:11.738919Z","submitted_at":"2025-06-16T12:52:19Z","title":"From Promise to Peril: Rethinking Cybersecurity Red and Blue Teaming in the Age of LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:34:59.444740Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2506.13434"},"observation_digest":"sha256:e9f355d9417184653bc1f9a8001d6d7ed72a5973fa1846b75ac18c9ee54c90ae","observation_id":"9bd0273a-027c-4ee1-aa47-e4326bda686a","resolution":{"observed_at":"2026-08-07T00:34:59.444740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-06T16:34:05.325342Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13169","last_updated":"2025-07-17T14:33:36Z","snapshot_observed_at":"2026-08-07T22:34:49.318621Z","submitted_at":"2025-07-17T14:33:36Z","title":"Prompt Injection 2.0: Hybrid AI Threats","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:34:05.325342Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2507.13169"},"observation_digest":"sha256:b7ee24a7321612ac46a21f8fb10f681a2c0db79cc3b93e6c11f9ebbe7d579986","observation_id":"53d2c546-ea9f-4636-bf87-72f6c0317db7","resolution":{"observed_at":"2026-08-06T16:34:05.325342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T18:45:32.515647Z","title":"arXiv preprint arXiv:2402.06664 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14183","last_updated":"2025-08-19T18:17:14Z","snapshot_observed_at":"2026-08-09T00:43:24.873203Z","submitted_at":"2025-08-19T18:17:14Z","title":"Relativistic Quantum Thermal Machine: Harnessing Relativistic Effects to Surpass Carnot Efficiency","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T18:45:32.515647Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2508.14183"},"observation_digest":"sha256:54daf352f70cd61646563cdb25dbaedc14b993768bb9fa68f840fe0076a55463","observation_id":"1e21aa17-16a5-4556-8435-8aeca8463df3","resolution":{"observed_at":"2026-08-05T18:45:32.515647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T15:43:58.906663Z","title":"LLM agents can au- tonomously hack websites, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00085","last_updated":"2025-08-27T07:08:44Z","snapshot_observed_at":"2026-08-07T12:15:31.193814Z","submitted_at":"2025-08-27T07:08:44Z","title":"Private, Verifiable, and Auditable AI Systems","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T15:43:58.906663Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2509.00085"},"observation_digest":"sha256:b2d2ca48559520c806e69b0386551dfa642cfae1e04e53425b486519701ba7af","observation_id":"58b93dd4-542f-4e85-9a89-768a58f31816","resolution":{"observed_at":"2026-08-05T15:43:58.906663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T14:20:11.831903Z","title":"Llm agents can autonomously hack websites, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00124","last_updated":"2025-08-29T08:14:52Z","snapshot_observed_at":"2026-08-07T07:48:03.397849Z","submitted_at":"2025-08-29T08:14:52Z","title":"A Whole New World: Creating a Parallel-Poisoned Web Only AI-Agents Can See","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T14:20:11.831903Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2509.00124"},"observation_digest":"sha256:6480712c9992f5be593848c8cf2e37dfcd9878c2e2a6ab57ec40028fba3961e7","observation_id":"77e4116d-3c65-4fde-963b-92cf4255aedb","resolution":{"observed_at":"2026-08-05T14:20:11.831903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2510.23883","last_updated":"2026-04-03T16:27:34Z","snapshot_observed_at":"2026-08-02T13:42:34.526072Z","submitted_at":"2025-10-27T21:48:11Z","title":"Agentic AI Security: Threats, Defenses, Evaluation, and Open Challenges","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-18T03:42:10.703369Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2510.23883"},"observation_digest":"sha256:a729581c5feaf30e350f3f3791a32d2472d642804b6c8bf8f8cde8f1fa5ee1f8","observation_id":"032ab1c7-17c6-4da4-94f8-8616ad896e51","resolution":{"observed_at":"2026-05-18T03:42:22.335983Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2512.22753","last_updated":"2026-04-22T21:48:07Z","snapshot_observed_at":"2026-08-08T22:14:34.218223Z","submitted_at":"2025-12-28T02:55:49Z","title":"From Rookie to Expert: Manipulating LLMs for Automated Vulnerability Exploitation in Enterprise Software","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T20:02:47.746439Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2512.22753"},"observation_digest":"sha256:ef227582dc0926dfa7fcc58851105ccfbcba43b6f680f2f49b7c141428a99555","observation_id":"35965de7-275b-4966-9dbb-03398b9274e1","resolution":{"observed_at":"2026-05-16T20:03:22.220576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-02T23:18:01.167485Z","title":"Llm agents can autonomously hack websites.arXiv preprint arXiv:2402.06664, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.14345","last_updated":"2026-06-20T15:35:41Z","snapshot_observed_at":"2026-08-08T15:40:24.345004Z","submitted_at":"2026-02-15T23:25:14Z","title":"AXE: Grey-Box Exploitability Confirmation for Localized Vulnerability Reports","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T23:18:01.167485Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2602.14345"},"observation_digest":"sha256:c8cbb31636643fa34c15b6373e5470fde2e9c365f7494f241aa485272954b013","observation_id":"22462863-1e8c-469f-a1de-2b18d9b4fd23","resolution":{"observed_at":"2026-08-02T23:18:01.167485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2602.17753","last_updated":"2026-05-06T13:43:46Z","snapshot_observed_at":"2026-08-06T12:13:42.632788Z","submitted_at":"2026-02-19T18:57:43Z","title":"The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T20:41:49.137745Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2602.17753"},"observation_digest":"sha256:ddf72a6669af04df1327f5d635d5fd968832daf409e5e6fa3350cd5d30abb3a6","observation_id":"6fc24854-8a65-45fd-b239-503b6ab8831a","resolution":{"observed_at":"2026-05-15T20:46:36.180529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-07-13T09:27:26.581889Z","title":"LLM agents can autonomously hack websites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.05439","last_updated":"2026-06-30T01:08:02Z","snapshot_observed_at":"2026-07-22T23:19:06.197639Z","submitted_at":"2026-04-07T05:19:59Z","title":"Scale-free congestion clusters in large-scale traffic networks: a continuum modeling study","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T09:27:26.581889Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.05439"},"observation_digest":"sha256:d3e7b53582657d55c321078dc53cd4e0b562a8def4871b0b15bd59cde85aeed8","observation_id":"43077ddc-fba7-42c7-84e1-9abbbab87ee1","resolution":{"observed_at":"2026-07-13T09:27:26.581889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.05440","last_updated":"2026-04-07T05:22:25Z","snapshot_observed_at":"2026-08-03T03:45:23.098897Z","submitted_at":"2026-04-07T05:22:25Z","title":"LanG -- A Governance-Aware Agentic AI Platform for Unified Security Operations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T19:53:05.325203Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.05440"},"observation_digest":"sha256:f1790e24be4b4c3914192869ec4c5d56c2b119750a09d51174fb08de3c7afe29","observation_id":"696cc0c6-de06-435e-abbc-4811ee70d463","resolution":{"observed_at":"2026-05-10T22:25:51.468032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.05719","last_updated":"2026-04-07T11:19:16Z","snapshot_observed_at":"2026-08-02T08:12:46.257370Z","submitted_at":"2026-04-07T11:19:16Z","title":"Hackers or Hallucinators? A Comprehensive Analysis of LLM-Based Automated Penetration Testing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T18:52:57.225878Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.05719"},"observation_digest":"sha256:a3c2f8dc4a2b136404a582182244296d530d2479fc60f7b5e673ca5065401a3b","observation_id":"c72fffc0-1a6a-4728-99d2-a6fbfe733fe8","resolution":{"observed_at":"2026-05-10T23:45:52.756965Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.10250","last_updated":"2026-04-11T15:29:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-11T15:29:08Z","title":"Organizational Security Resource Estimation via Vulnerability Queueing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T15:38:42.034463Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.10250"},"observation_digest":"sha256:c09ceb798ecf11efa5d8aac6b479e53ac9210197a2b0c20f5169fc60471e3d1d","observation_id":"bbd5ba17-5eae-4e50-9482-9092d2a89467","resolution":{"observed_at":"2026-05-11T10:06:03.503422Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.17159","last_updated":"2026-04-18T22:13:23Z","snapshot_observed_at":"2026-08-03T22:57:17.276813Z","submitted_at":"2026-04-18T22:13:23Z","title":"Systematic Capability Benchmarking of Frontier Large Language Models for Offensive Cyber Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T06:02:32.399075Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.17159"},"observation_digest":"sha256:0f31f25b30d95bb19e86eda9e198e7cd1391687996e1439e5c9825ddc3680a79","observation_id":"479d3493-16c0-438e-8fbb-2b1b43ddccdd","resolution":{"observed_at":"2026-05-10T06:06:19.079644Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.18718","last_updated":"2026-04-20T18:17:51Z","snapshot_observed_at":"2026-08-05T14:04:49.062431Z","submitted_at":"2026-04-20T18:17:51Z","title":"Towards Optimal Agentic Architectures for Offensive Security Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T04:02:04.359269Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.18718"},"observation_digest":"sha256:0a20ae597a98a1844da17699b3a32d20391cf851c15ba131dcaa219302b73809","observation_id":"9ccf7805-1395-4fe6-adb5-b308ad0424a1","resolution":{"observed_at":"2026-05-11T12:16:03.122466Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2604.20801","last_updated":"2026-04-22T17:27:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T17:27:40Z","title":"Synthesizing Multi-Agent Harnesses for Vulnerability Discovery","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T00:17:26.218561Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2604.20801"},"observation_digest":"sha256:558d22a250bce92d5d316bf13799a7ef132f627ab5a1e84c4dc31a4ce6d073b6","observation_id":"b7ed002d-c805-40fe-a26d-6ad50b41b9a7","resolution":{"observed_at":"2026-05-10T00:19:46.399952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.06713","last_updated":"2026-05-06T23:23:26Z","snapshot_observed_at":"2026-07-31T23:54:37.194402Z","submitted_at":"2026-05-06T23:23:26Z","title":"Agentic AI and the Industrialization of Cyber Offense: Forecast, Consequences, and Defensive Priorities for Enterprises and the Mittelstand","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:23:55.894827Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.06713"},"observation_digest":"sha256:b90b568ce2ef4cbb2444d1b26fe64bc2a4664b719ed018ac74556488af4ebad3","observation_id":"3dde665b-26d7-41ee-84f0-2341b530ca97","resolution":{"observed_at":"2026-05-11T04:25:58.395217Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.08316","last_updated":"2026-05-08T14:58:52Z","snapshot_observed_at":"2026-08-04T08:55:54.382325Z","submitted_at":"2026-05-08T14:58:52Z","title":"AI-Driven Security Alert Screening and Alert Fatigue Mitigation in Security Operations Centers: A Comprehensive Survey","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T00:50:39.655353Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.08316"},"observation_digest":"sha256:712c9a1879f6b185277d7563917ffdcc8b8c35d3f3dbe0c2a40a91ca93b28f99","observation_id":"dd9063d0-26b6-479f-91ee-2c0171da0163","resolution":{"observed_at":"2026-05-12T00:51:14.776871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.12916","last_updated":"2026-05-13T02:44:08Z","snapshot_observed_at":"2026-08-07T16:11:26.473880Z","submitted_at":"2026-05-13T02:44:08Z","title":"SHM-Agents: A Generalist-Specialist Integrated Agent System for Structural Health Monitoring","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T21:50:07.617384Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.12916"},"observation_digest":"sha256:d00cc95a1367bf75ee9365084fa760fde2f0749a97e010d43e1c930653130856","observation_id":"6a20f1d8-7cab-4e46-8bf4-5da110b37698","resolution":{"observed_at":"2026-06-30T21:55:04.889288Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.15228","last_updated":"2026-05-13T17:58:52Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-13T17:58:52Z","title":"Verifiable Agentic Infrastructure: Proof-Derived Authorization for Sovereign AI Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T17:30:08.476165Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.15228"},"observation_digest":"sha256:6de4f6533148a5639319d742ea39738f4b806d410bb189f7040f0b3bf2645152","observation_id":"f3b18c20-0697-4e92-a9da-5558869227dc","resolution":{"observed_at":"2026-05-19T17:32:41.713561Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.17416","last_updated":"2026-05-17T12:24:11Z","snapshot_observed_at":"2026-08-05T17:00:32.094950Z","submitted_at":"2026-05-17T12:24:11Z","title":"Benchmarking Mythos-Linked Bug Rediscovery","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T23:14:34.164854Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.17416"},"observation_digest":"sha256:647445fd8f359ac600d64d54c9a7748c44aaf179fd93b529e7c3988a52ba57c2","observation_id":"70593040-75ec-4a28-b43b-25d04ea945f6","resolution":{"observed_at":"2026-05-19T23:17:57.562883Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.24949","last_updated":"2026-05-24T08:54:33Z","snapshot_observed_at":"2026-08-02T01:35:39.565582Z","submitted_at":"2026-05-24T08:54:33Z","title":"APT-Agent: Automated Penetration Testing using Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T00:11:02.928108Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.24949"},"observation_digest":"sha256:4f1aef3795d4e409e88524a83beb0128be08e59fbb94738e6e19094357aac030","observation_id":"fe26ee07-21d3-49fb-9d06-4e28f6192c46","resolution":{"observed_at":"2026-06-30T00:14:04.084144Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.24949","last_updated":"2026-05-24T08:54:33Z","snapshot_observed_at":"2026-08-02T01:35:39.565582Z","submitted_at":"2026-05-24T08:54:33Z","title":"APT-Agent: Automated Penetration Testing using Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T00:11:02.928108Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.24949"},"observation_digest":"sha256:e433a91bea2b2a64d3811de67213fe5777544674ab724f1584140bb85279142b","observation_id":"1fbbc008-f672-4c46-9ef9-1bc5e4afbfc0","resolution":{"observed_at":"2026-06-30T00:14:03.916561Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2605.30096","last_updated":"2026-05-28T15:39:43Z","snapshot_observed_at":"2026-08-08T19:27:59.265761Z","submitted_at":"2026-05-28T15:39:43Z","title":"How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T06:53:48.841077Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2605.30096"},"observation_digest":"sha256:27cd80bc21fdb15480048d9e39cbfb8ee4ea9f34b7093660dfae748a266a1fce","observation_id":"42062744-44f8-479f-9444-f9a774c2bb5c","resolution":{"observed_at":"2026-06-29T14:13:30.533018Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2606.01494","last_updated":"2026-05-31T23:20:25Z","snapshot_observed_at":"2026-08-03T02:26:02.362928Z","submitted_at":"2026-05-31T23:20:25Z","title":"ClawHub Security Signals: When VirusTotal, Static Analysis, and SkillSpector Disagree","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T16:31:00.638181Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2606.01494"},"observation_digest":"sha256:ff75d14a67f8708dbe45406491f5cd431c2e61fd8b77d617037d2896562adee6","observation_id":"9032e5aa-90db-462f-9274-dfe921a29189","resolution":{"observed_at":"2026-07-01T21:36:15.888449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2606.10749","last_updated":"2026-06-09T12:01:07Z","snapshot_observed_at":"2026-07-31T21:35:18.696472Z","submitted_at":"2026-06-09T12:01:07Z","title":"Toward Secure LLM Agents: Threat Surfaces, Attacks, Defenses, and Evaluation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T12:55:22.831264Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2606.10749"},"observation_digest":"sha256:288f8cf628b7cfe0164f09ec05506a24b71c1cdbf03e9e86d2eda72034565308","observation_id":"7b16bb85-0344-4ec7-ae10-230f7f1b20aa","resolution":{"observed_at":"2026-06-27T13:20:56.792731Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2606.19149","last_updated":"2026-06-18T15:18:52Z","snapshot_observed_at":"2026-08-07T15:17:29.184846Z","submitted_at":"2026-06-17T14:56:04Z","title":"OpenAnt: LLM-Powered Vulnerability Discovery Through Code Decomposition, Adversarial Verification, and Dynamic Testing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T20:21:37.520539Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2606.19149"},"observation_digest":"sha256:d97409ef754db6339987dca7828e29a1b99c035e3aa8ff571b94c507d53e5047","observation_id":"8698cf35-9589-460e-b60a-162bf783829b","resolution":{"observed_at":"2026-07-04T01:29:22.415726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2606.24402","last_updated":"2026-06-23T10:37:34Z","snapshot_observed_at":"2026-08-03T12:40:07.880667Z","submitted_at":"2026-06-23T10:37:34Z","title":"Poisoned Playbooks: Demystifying Knowledge Poisoning Effects on AI Security Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T23:27:14.610097Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2606.24402"},"observation_digest":"sha256:b51b4011b32e8cbf09a83221467409c6f2e28d5027740528b97021991e666943","observation_id":"757d6456-2829-4ba4-bfa5-faa18ebe1bf8","resolution":{"observed_at":"2026-07-04T17:50:00.000930Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":"2402.06664","doi":"10.48550/arxiv.2402.06664","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Richard Fang, Rohan Bindu, Akul Gupta, Qiusi Zhan, and Daniel Kang","venue":"arXiv (Cornell University)","work_id":"bfd110c5-1c7c-43b5-b089-536abb8ca4f2","year":2024},"citing_paper":{"arxiv_id":"2606.25332","last_updated":"2026-06-24T02:51:58Z","snapshot_observed_at":"2026-08-07T07:58:51.676341Z","submitted_at":"2026-06-24T02:51:58Z","title":"Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T21:23:32.255067Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2606.25332"},"observation_digest":"sha256:1f8754c94c2406ba256f5f5c4e9ccda228ab55796bc5f9a2c3674b22fdf2f382","observation_id":"792557bd-e77e-401e-afa2-3e89ae845b2d","resolution":{"observed_at":"2026-07-04T19:20:07.165656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-07-12T09:10:11.585499Z","title":"Llm agents can autonomously hack websites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02605","last_updated":"2026-07-01T13:24:25Z","snapshot_observed_at":"2026-07-12T09:10:10.458200Z","submitted_at":"2026-07-01T13:24:25Z","title":"A Survey of LLM-Driven Penetration Testing: Taxonomy, Co-Evolution, and Open Challenges","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-12T09:10:11.585499Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.02605"},"observation_digest":"sha256:55b35983b696b993c97e4aef975627871cbc8061b7e8f37be2fe78b930fdd547","observation_id":"70ff2b12-b7b1-4391-adcf-f750b30954a5","resolution":{"observed_at":"2026-07-12T09:10:11.585499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-01T15:04:05.811127Z","title":"Llm agents can autonomously hack websites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18575","last_updated":"2026-07-20T23:16:16Z","snapshot_observed_at":"2026-08-07T04:18:18.738832Z","submitted_at":"2026-07-20T23:16:16Z","title":"RECEIPT: Deterministic, Reward-Hacking-Resistant Verification for White-Box Agentic XSS Discovery","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:04:05.811127Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.18575"},"observation_digest":"sha256:07f06b2528067b80074ec4608182226080297a391b5da9a5b7c887dd6689cf3b","observation_id":"c0b4c996-f50f-4154-a79c-108252658275","resolution":{"observed_at":"2026-08-01T15:04:05.811127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-01T06:04:46.754584Z","title":"arXiv preprint arXiv:2402.06664 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22024","last_updated":"2026-07-24T06:43:09Z","snapshot_observed_at":"2026-08-08T12:54:01.031419Z","submitted_at":"2026-07-24T06:43:09Z","title":"Agent Security Needs Redefinition through a Holistic Framework","version":1},"reference_index":300,"source":"arxiv_source","source_observed_at":"2026-08-01T06:04:46.754584Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.22024"},"observation_digest":"sha256:ff2769ad2d54add50f168be98be4614d6209c3948c119c51cfb6f0bd22a7495a","observation_id":"9ef4dbba-eddb-4525-a825-8066b65ede1b","resolution":{"observed_at":"2026-08-01T06:04:46.754584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-01T02:40:29.368884Z","title":"Llm agents can autonomously hack websites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-06T23:11:27.985138Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T02:40:29.368884Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:c1f4222c70d9e745819ce27c6fce468193dbd6d187035a1ba2795e70fb057183","observation_id":"d0ae1f08-c5c3-42c0-ad4f-8d46014a07bd","resolution":{"observed_at":"2026-08-01T02:40:29.368884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-04T01:33:20.480890Z","title":"Llm agents can autonomously hack websites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-06T23:11:27.985138Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.480890Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:72a48de0dfa8645ef43aed9918b8662330bcff9c2681716e2ba5b7990dedb234","observation_id":"8de1c133-ebbc-411f-a9b8-957d524402c2","resolution":{"observed_at":"2026-08-04T01:33:20.480890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-08T04:19:18.946403Z","title":"arXiv preprint arXiv:2402.06664 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03009","last_updated":"2026-08-04T01:42:43Z","snapshot_observed_at":"2026-08-09T09:33:23.692118Z","submitted_at":"2026-08-04T01:42:43Z","title":"Tiny Enough to Break In: Agentic Remote Access Trojans Powered by Small Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T04:19:18.946403Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2608.03009"},"observation_digest":"sha256:39dbcbd63af0e440b7acb4d0fc229c48e13160bfbe0965ff7a728d7442f6d7b3","observation_id":"3956c394-6f05-49dd-8096-2a6124de3c9a","resolution":{"observed_at":"2026-08-08T04:19:18.946403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-08T19:58:17.213871Z","title":"Llm agents can autonomously hack websites.arXiv preprint arXiv:2402.06664, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04317","last_updated":"2026-08-05T00:54:57Z","snapshot_observed_at":"2026-08-09T19:45:40.565565Z","submitted_at":"2026-08-05T00:54:57Z","title":"Trident : How to Break Deep Reinforcement Learning Cyber Defenses (Agentic)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T19:58:17.213871Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2608.04317"},"observation_digest":"sha256:da5da7608082a3c78c86d72d0a4b3e0e505c2174febac5d95347adfa7fee807f","observation_id":"8d7de844-f4f5-43d7-aa20-28fb6659842a","resolution":{"observed_at":"2026-08-08T19:58:17.213871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-06T17:27:26.339268Z","title":"Llm agents can autonomously hack websites.arXiv preprint arXiv:2402.06664, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04755","last_updated":"2026-08-05T12:23:16Z","snapshot_observed_at":"2026-08-08T23:12:25.249367Z","submitted_at":"2026-08-05T12:23:16Z","title":"\"Allow\" to Achieve, Over-Privileged Inadvertently: The Unintended Cost of Task-Completion-Driven Pop-up Decisions in Mobile GUI Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:27:26.339268Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2608.04755"},"observation_digest":"sha256:1f5d9c944f4084b62629dc80712f479a1821b1c5660f365ea0667afea6e09a5e","observation_id":"278ea0f0-8105-4a49-abb5-92a63d0d3768","resolution":{"observed_at":"2026-08-06T17:27:26.339268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.06664/citation-record","integrity":"/paper/2402.06664/integrity","json":"/paper/2402.06664/citation-record.json","paper":"/paper/2402.06664"},"outbound":[],"paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T10:02:21.156103Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 47 inbound Pith citation observations for arXiv:2402.06664."}