{"as_of":"2026-08-09T17:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e963faae082138fb5fa31ab0759d38cbe9f44c455ceeaef2629046e9e0c125a1","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:12:44.201592Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26115/citation-record","integrity":"/paper/2607.26115/integrity","json":"/paper/2607.26115/citation-record.json","paper":"/paper/2607.26115"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.13352","last_updated":"2024-11-24T22:04:23Z","snapshot_observed_at":"2026-07-06T18:33:32.806635Z","submitted_at":"2024-06-19T08:55:56Z","title":"AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13352","snapshot_observed_at":"2026-08-01T01:12:44.130108Z","title":"Deng, Y., Yang, Y., Zhang, J., Wang, W., and Li, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.130108Z"},"links":{"cited_paper":"/paper/2406.13352","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:e7da59e841e00f91eee74eb62b3822eeb998cde4c224cb5850cd7ca53d57b639","observation_id":"7be87c14-6d5f-4a38-83dc-6b1456f5942a","resolution":{"observed_at":"2026-08-01T01:12:44.130108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:12:44.135153Z","title":"How vulnerable are ai agents to indirect prompt injections? insights from a large‐ scalepubliccompetition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.135153Z"},"links":{"citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:f11756addf14c3c06d6447f0480aea3d6a3a8a3661fa32a2e3f1107e822a54f4","observation_id":"e14ae957-196f-4a65-a724-239d6e7160d5","resolution":{"observed_at":"2026-08-01T01:12:44.135153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07689","last_updated":"2023-11-13T19:13:29Z","snapshot_observed_at":"2026-07-06T16:47:01.374736Z","submitted_at":"2023-11-13T19:13:29Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07689","snapshot_observed_at":"2026-08-01T01:12:44.140186Z","title":"Goodfellow, I","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.140186Z"},"links":{"cited_paper":"/paper/2311.07689","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:ee7e88ba3a918e0c33efb8b0af778b9d9b8a16c61082116fbb6d45f84688edd3","observation_id":"64677a4b-47eb-40e2-af4b-f333ce154e4c","resolution":{"observed_at":"2026-08-01T01:12:44.140186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-01T01:12:44.145869Z","title":"Nasr, M., Carlini, N., Sitawarin, C., Schulhoff, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.145869Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:e0e156d3d96909bd5f83fc4866307bf2c1ff1d41120bec247b29e5f930a18803","observation_id":"6ad47015-6eeb-423d-8168-b57de8d569cb","resolution":{"observed_at":"2026-08-01T01:12:44.145869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-01T01:12:44.151768Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.151768Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:99eac7a597c9d539e0f4507c25e2cd32a64431c7d9a6bd797dacb182c62ca045","observation_id":"04b3dc29-8c72-48d4-bcbf-e2af7d5700b8","resolution":{"observed_at":"2026-08-01T01:12:44.151768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:12:44.164253Z","title":"Toyer, S., Watkins, O., Mendes, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.164253Z"},"links":{"citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:209dcf2f0448492877cdb25af0fdb7cb8f5ab182b3d64ef176a439c0154838f0","observation_id":"bd147938-f0fd-44a5-bc2b-366b870efa8e","resolution":{"observed_at":"2026-08-01T01:12:44.164253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05849","last_updated":"2025-06-14T01:50:21Z","snapshot_observed_at":"2026-08-07T15:48:32.528659Z","submitted_at":"2025-05-09T07:40:17Z","title":"AgentVigil: Generic Black-Box Red-teaming for Indirect Prompt Injection against LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05849","snapshot_observed_at":"2026-08-01T01:12:44.169745Z","title":"Willison, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.169745Z"},"links":{"cited_paper":"/paper/2505.05849","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:f9815d400c661f2b40d182a567860726aa6d3a2e3f52b3749975e0287919a775","observation_id":"c76f5e9b-e5d3-4311-b3ff-1e806e38fac5","resolution":{"observed_at":"2026-08-01T01:12:44.169745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:12:44.174390Z","title":"Xu, H., Zhang, W., Wang, Z., Xiao, F., Zheng, R., Feng, Y., Ba, Z., and Ren, K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.174390Z"},"links":{"citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:8e6b2f3c2efa9c0666fcf1fc01a31105dab3d469520c012c7c780ae16ee08a59","observation_id":"717e47b6-1b6c-41c6-9307-4c7c5dc2ca33","resolution":{"observed_at":"2026-08-01T01:12:44.174390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-09T12:04:54.748826Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-01T01:12:44.184834Z","title":"Yu,J.,Lin,X.,Yu,Z.,andXing,X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.184834Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:909e0a455ecd560b52fe2be7cb5206e9d9189fa6210d999b6a469e4018ce5e61","observation_id":"b3b09427-a1e8-4a06-a09e-bb0a28d19412","resolution":{"observed_at":"2026-08-01T01:12:44.184834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02691","last_updated":"2024-08-04T04:52:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-05T06:21:45Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02691","snapshot_observed_at":"2026-08-01T01:12:44.189784Z","title":"Zhang, H., Huang, J., Mei, K., Yao, Y., Wang, Z., Zhan, C., Wang, H., and Zhang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.189784Z"},"links":{"cited_paper":"/paper/2403.02691","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:b9b4b581a809a7a18b7d4eab3d4c64f41dc053de8351b55883fa6500c134d262","observation_id":"2c4aff08-d08a-456a-9bd9-6ea58d236fa6","resolution":{"observed_at":"2026-08-01T01:12:44.189784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02644","last_updated":"2025-05-30T03:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-03T16:30:47Z","title":"Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02644","snapshot_observed_at":"2026-08-01T01:12:44.195947Z","title":"Zou,A., Wang,Z., Kolter, J.Z., andFredrikson, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.195947Z"},"links":{"cited_paper":"/paper/2410.02644","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:857d00faaeae3827f206265398fb297f77553dbc021d009ec121c2ed2f992f87","observation_id":"03156622-021f-43a8-884d-63311c262b19","resolution":{"observed_at":"2026-08-01T01:12:44.195947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20526","last_updated":"2025-07-28T05:13:04Z","snapshot_observed_at":"2026-08-09T17:08:31.139462Z","submitted_at":"2025-07-28T05:13:04Z","title":"Security Challenges in AI Agent Deployment: Insights from a Large Scale Public Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20526","snapshot_observed_at":"2026-08-01T01:12:44.201592Z","title":"content\":","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.201592Z"},"links":{"cited_paper":"/paper/2507.20526","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:c9fa1587fbceb59c863176d7583fc3fe1e71843bcb2fbf035a6b42a74b2750d4","observation_id":"c442ccb6-1671-4e00-a6cb-4a169654a8a0","resolution":{"observed_at":"2026-08-01T01:12:44.201592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-01T01:12:44.113665Z","title":"Bazinska, J., Mathys, M., Casucci, F., Rojas‐Carulla, M., Davies,X.,Souly,A.,andPfister,N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.113665Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:4e8f1e9d31758b3bfaea5f1547ff26ea2d77d2d930922f982af13b09d246fbea","observation_id":"8c0e98fb-81ec-46f8-8f73-c93b7bb478cb","resolution":{"observed_at":"2026-08-01T01:12:44.113665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-01T01:12:44.124317Z","title":"Chaudhari, H., Severi, G., Abascal, J., Jagielski, M., Choquette‐Choo, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.124317Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:9a179a8bb9d4f91a89deeba3336582145c181b7b10ff17ae2de0a6d0d84681a0","observation_id":"ed6572bb-4fb9-4054-b5d4-bdafaec6e790","resolution":{"observed_at":"2026-08-01T01:12:44.124317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-02T12:38:54.249632Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-08-01T01:12:44.107279Z","title":"Anil, C., Durmus, E., Sharma, M., Benton, J., Kundu, S., Batson,J.,etal","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.107279Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:dbac26114562b6b0f5de6d5f3d36fa22e5a264f1a66e539422ed2b8dfdc6f056","observation_id":"e9a38d2f-ccfa-47e0-bf9f-04bd2014c4c3","resolution":{"observed_at":"2026-08-01T01:12:44.107279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-01T01:12:44.118461Z","title":"Beutel, A., Xiao, K., Heidecke, J., and Weng, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.118461Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:8b9a75dd680161af7d823b8d6b6148d14cd67c6814b365aaf323c567285d9b14","observation_id":"e8a800fe-adaf-4bc1-b6ff-5bf651c93279","resolution":{"observed_at":"2026-08-01T01:12:44.118461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14534","last_updated":"2025-05-20T15:54:45Z","snapshot_observed_at":"2026-08-08T20:01:40.635798Z","submitted_at":"2025-05-20T15:54:45Z","title":"Lessons from Defending Gemini Against Indirect Prompt Injections","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14534","snapshot_observed_at":"2026-08-01T01:12:44.157635Z","title":"METRblogpost","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.157635Z"},"links":{"cited_paper":"/paper/2505.14534","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:3edbd740da4e61efd9d98e6a950fea829627cc8b15e74e8ce5bbaef419f1f468","observation_id":"87c63fa4-9d67-41ee-948b-c36bd79adb0b","resolution":{"observed_at":"2026-08-01T01:12:44.157635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.12277","last_updated":"2026-06-27T01:09:30Z","snapshot_observed_at":"2026-08-02T21:46:08.650145Z","submitted_at":"2026-02-22T18:43:34Z","title":"Prompt Injection as Role Confusion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.12277","snapshot_observed_at":"2026-08-01T01:12:44.179664Z","title":"Promptinjectionas roleconfusion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":6667,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.179664Z"},"links":{"cited_paper":"/paper/2603.12277","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:2d4a9188d5a2eb774f1759d13877a468719f95076753dea73fd0ad216ba5701d","observation_id":"1582961c-4a0f-43f7-ac87-96b5e90e24af","resolution":{"observed_at":"2026-08-01T01:12:44.179664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T02:51:10.943881Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.26115."}