{"as_of":"2026-08-10T03:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc9700581759e9bfaac15d7965b1e41a16ce70c11b46f655d20db333ccb71b5d","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:16:15.489997Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00134/citation-record","integrity":"/paper/2608.00134/integrity","json":"/paper/2608.00134/citation-record.json","paper":"/paper/2608.00134"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T01:16:09.264836Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.264836Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a6417508f0ed4822e44a78843c1ab089f173c3da1eebbc161dbe749b845f5ab9","observation_id":"798a21b2-7217-4fa7-b796-04582796ca4b","resolution":{"observed_at":"2026-08-04T01:16:09.264836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-04T01:16:09.358040Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.358040Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b87841c32f6ee8d9ad8444b4c5485ce284e9eba431b1c3e1ebd1e17f3bc9f53d","observation_id":"7e9400a6-d005-41c6-add6-9971e971b577","resolution":{"observed_at":"2026-08-04T01:16:09.358040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T01:16:09.397390Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.397390Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:9ac3d28465c92c07798459876952cf505a52e0be43e0fb71e5deb13b2de9dbb8","observation_id":"197cda93-1f6e-451b-ba6b-589f4480435f","resolution":{"observed_at":"2026-08-04T01:16:09.397390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05112","last_updated":"2024-07-22T12:16:30Z","snapshot_observed_at":"2026-07-06T16:45:03.211791Z","submitted_at":"2023-11-09T02:55:58Z","title":"A Survey of Large Language Models in Medicine: Progress, Application, and Challenge","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05112","snapshot_observed_at":"2026-08-04T01:16:09.467147Z","title":"A survey of large language models in medicine: Progress, application, and challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.467147Z"},"links":{"cited_paper":"/paper/2311.05112","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:83274c9182e3d5510c8cf7473cb5b27907f5a1e5815b1de6e86692bf4d1fabdd","observation_id":"1afd53bc-d838-4a72-8bd4-2cb3df258454","resolution":{"observed_at":"2026-08-04T01:16:09.467147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04199","last_updated":"2023-11-07T18:39:10Z","snapshot_observed_at":"2026-08-09T15:24:57.046307Z","submitted_at":"2023-11-07T18:39:10Z","title":"Exploring Recommendation Capabilities of GPT-4V(ision): A Preliminary Case Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04199","snapshot_observed_at":"2026-08-04T01:16:09.515819Z","title":"Exploring recommendation capabilities of gpt-4v (ision): A preliminary case study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.515819Z"},"links":{"cited_paper":"/paper/2311.04199","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:729ba2b968798583e2858d1a5d006b224b81428bbefaa753c53cc3df5b6eefa3","observation_id":"155f7a77-09a2-4a6b-b4de-b421612b25a3","resolution":{"observed_at":"2026-08-04T01:16:09.515819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.563310Z","title":"{LLM-Fuzzer}: Scaling assessment of large language model jailbreaks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.563310Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8f8bfd3ad5e07186abd03f6e0685d81cfdcae3adc9044752dc6ddcc59159c8fb","observation_id":"d1e15201-e534-458f-aad3-c61eaa37143d","resolution":{"observed_at":"2026-08-04T01:16:09.563310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08615","last_updated":"2024-12-16T04:05:45Z","snapshot_observed_at":"2026-07-06T20:05:28.003434Z","submitted_at":"2024-12-11T18:37:56Z","title":"Exploiting the Index Gradients for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08615","snapshot_observed_at":"2026-08-04T01:16:09.626615Z","title":"Exploiting the index gradients for optimization-based jailbreaking on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.626615Z"},"links":{"cited_paper":"/paper/2412.08615","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:afa5b85378842a7c2f2d9e293dc325603917a72e5e9ad1f05462b77a69a72300","observation_id":"bb0cadd4-0fc1-4fa6-ba87-396222896a5e","resolution":{"observed_at":"2026-08-04T01:16:09.626615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.673549Z","title":"Making them ask and answer: Jailbreaking large language models in few queries via disguise and reconstruction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.673549Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:87162a79b22cb3f429eabc49f0fa698fdbb3da6f257256fa962ee208d42b34ea","observation_id":"ab6b3cef-02ed-44c9-aa4b-6c404eb1e212","resolution":{"observed_at":"2026-08-04T01:16:09.673549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.743694Z","title":"Helping big language models protect themselves: An enhanced filtering and summarization system,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.743694Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:84c46215f0da92c61c886cb285c74b1d87d62251cd4ddcdd3821569b744d2f61","observation_id":"986c3a0b-3af2-4f0f-9beb-c9e6bdff0a39","resolution":{"observed_at":"2026-08-04T01:16:09.743694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13203","last_updated":"2025-08-23T02:09:57Z","snapshot_observed_at":"2026-08-08T01:21:45.503189Z","submitted_at":"2025-04-15T16:11:28Z","title":"X-Teaming: Multi-Turn Jailbreaks and Defenses with Adaptive Multi-Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13203","snapshot_observed_at":"2026-08-04T01:16:09.808925Z","title":"X-teaming: Multi- turn jailbreaks and defenses with adaptive multi-agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.808925Z"},"links":{"cited_paper":"/paper/2504.13203","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:e79c15a633ca0004c6e7c6c578efef2394734ba50f43d816cd3d28224d0f8aec","observation_id":"404c6bc3-e694-4d71-8157-9785c1c560ff","resolution":{"observed_at":"2026-08-04T01:16:09.808925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-04T01:16:09.952167Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.952167Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:fa3de2d50ea84c269447b4f84bf66eb3314b87fb87d0e645171b1cad9d0489b9","observation_id":"42419e43-111b-46b5-987d-646f2b11d314","resolution":{"observed_at":"2026-08-04T01:16:09.952167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.059041Z","title":"Datasentinel: A game-theoretic detection of prompt injection attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.059041Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:d9545f9582055ba7a5fedcc6833900277345b8c13eee4a9e49634f7fc507678f","observation_id":"37abdc89-91e0-4d96-b872-5b08253372c3","resolution":{"observed_at":"2026-08-04T01:16:10.059041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-04T01:16:10.099322Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.099322Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:55c950e6dc9661987f94247806af723e44cf8bfda23e5439b94fedc6e7bd0294","observation_id":"d9fddcb5-449b-45cc-b026-56190ae5a93b","resolution":{"observed_at":"2026-08-04T01:16:10.099322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.155570Z","title":"Fight back against jailbreaking via prompt adversarial tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.155570Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:bddf2c0ec67a7eb224d6cdf8251cd8bc374f77c2bff96caa3def55b4e393fafa","observation_id":"61e51d5b-99a8-4d04-bdca-02bb060bf374","resolution":{"observed_at":"2026-08-04T01:16:10.155570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07875","last_updated":"2024-03-19T16:50:50Z","snapshot_observed_at":"2026-08-06T23:45:57.910675Z","submitted_at":"2023-09-14T17:23:37Z","title":"Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07875","snapshot_observed_at":"2026-08-04T01:16:10.204874Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.204874Z"},"links":{"cited_paper":"/paper/2309.07875","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0e131a26dd41cc00ac1ddd0a529306650d32d92473d38378b90ac4036b82df96","observation_id":"6b501988-70d3-46de-a021-4fa32eacd20a","resolution":{"observed_at":"2026-08-04T01:16:10.204874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.255483Z","title":"Distributional preference learning: Understanding and accounting for hidden context in rlhf,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.255483Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:037182356dc7e62f84f2c7325d07c41dcaadd3bd0d643d623cc8fcfa4318a4cb","observation_id":"7a4e43e2-0e5d-4de7-bdcb-23599c9c7c44","resolution":{"observed_at":"2026-08-04T01:16:10.255483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09154","last_updated":"2025-03-03T09:37:27Z","snapshot_observed_at":"2026-08-03T17:59:18.731227Z","submitted_at":"2024-02-14T13:13:26Z","title":"Attacking Large Language Models with Projected Gradient Descent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09154","snapshot_observed_at":"2026-08-04T01:16:10.330416Z","title":"Attacking large language models with projected gradient descent,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.330416Z"},"links":{"cited_paper":"/paper/2402.09154","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:e655237cdf2564f93397b7dabf0b28be517cb8606328791fa1f2684f30b103a0","observation_id":"c5232ba9-5422-459d-ba88-940486fce466","resolution":{"observed_at":"2026-08-04T01:16:10.330416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-04T01:16:10.406423Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.406423Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:dc10eabfe66bff7208cdac5b1280351491c7b2f5d97822f9470c06f46d003cfa","observation_id":"fa11cee1-adf0-4aaf-9489-059349dd9982","resolution":{"observed_at":"2026-08-04T01:16:10.406423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-04T01:16:10.469528Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.469528Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:30ef264d1858f5d865cf2724a91271b7673cee221a0c372b0610af5e16dcfdaf","observation_id":"0f7201d3-4551-4f8f-a646-d595f553792f","resolution":{"observed_at":"2026-08-04T01:16:10.469528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-05T10:26:02.067012Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-04T01:16:10.569808Z","title":"Ad- vprompter: Fast adaptive adversarial prompting for llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.569808Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:f52d1cdfde35dd123e0bc58498b68518bcb3404432725bb0dde5dc877d4cf5e3","observation_id":"a36c6875-97c0-47a9-8bd8-25e0b0f97ecd","resolution":{"observed_at":"2026-08-04T01:16:10.569808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-07-06T17:14:36.670116Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-04T01:16:10.686916Z","title":"How johnny can persuade llms to jailbreak them: Rethinking persuasion to challenge ai safety by humanizing llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.686916Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c2c4c33316491f5b080cd8fdb5ded6a2de7be018d6c04edaf3dd1d3241dd2a68","observation_id":"a37eead2-fe61-4568-bb8d-e8cebb9cacac","resolution":{"observed_at":"2026-08-04T01:16:10.686916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-04T01:16:10.758446Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.758446Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:e330f2cbe94eb96bce3192200df44d25808e0a2caaa2b87873537c7973bc4d5b","observation_id":"15e36a56-ffb3-45ed-9880-b7a8ba38d7b5","resolution":{"observed_at":"2026-08-04T01:16:10.758446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.811489Z","title":"Honeytrap: Deceiving large language model attackers to honeypot traps with resilient multi-agent defense,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.811489Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8ec6a94219575c5f2f26ea5d511cc27f4c5c42f3f2db99324396fa5b1e0c385d","observation_id":"b286444e-f098-4bb3-affc-415bf51b6227","resolution":{"observed_at":"2026-08-04T01:16:10.811489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01833","last_updated":"2025-02-26T13:41:41Z","snapshot_observed_at":"2026-08-03T07:26:39.431128Z","submitted_at":"2024-04-02T10:45:49Z","title":"Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01833","snapshot_observed_at":"2026-08-04T01:16:10.875255Z","title":"Great, now write an article about that: The crescendo multi-turn llm jailbreak attack,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.875255Z"},"links":{"cited_paper":"/paper/2404.01833","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:3aea57acac8831ef028d1d1a5cc6228a0875939abba4a310accdc93779179143","observation_id":"75924873-2eeb-426e-8578-a3e07ec5c661","resolution":{"observed_at":"2026-08-04T01:16:10.875255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.989189Z","title":"Tree of attacks: Jailbreaking black-box llms automatically,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.989189Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:97c6da2d4d43adcc6164efdea1bfc71ed33356b6d703fd36b9561f70e3dcfe68","observation_id":"f2c38328-d87e-4d06-bd39-e9b7c027bb6d","resolution":{"observed_at":"2026-08-04T01:16:10.989189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14866","last_updated":"2025-03-03T07:25:21Z","snapshot_observed_at":"2026-07-06T19:20:19.151388Z","submitted_at":"2024-09-23T10:03:09Z","title":"PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14866","snapshot_observed_at":"2026-08-04T01:16:11.117001Z","title":"Effective and evasive fuzz testing-driven jailbreaking attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.117001Z"},"links":{"cited_paper":"/paper/2409.14866","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:03268df19ff97e9245a3d89f6e422a37b03884486017d11d3064be17a7749bed","observation_id":"698e5121-2960-4aa4-a4cb-2b58e6633457","resolution":{"observed_at":"2026-08-04T01:16:11.117001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.197104Z","title":"” do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.197104Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:7a3dcc3ebfb775e03f42d38c05e94dd5a6351e28142d22b43619eacb75d9c56f","observation_id":"6b57bb15-a2bf-48a0-aead-4011b5f951a5","resolution":{"observed_at":"2026-08-04T01:16:11.197104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09324","last_updated":"2024-11-06T04:43:57Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T17:01:40Z","title":"Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09324","snapshot_observed_at":"2026-08-04T01:16:11.264145Z","title":"Bag of tricks: Benchmarking of jailbreak attacks on llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.264145Z"},"links":{"cited_paper":"/paper/2406.09324","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:2f6a700b9eb84443e8bea9829cadb1d9febaf800f8ea50d8d035de6f72c1c71a","observation_id":"1e0a7775-d09c-445a-b87c-59792a2412ed","resolution":{"observed_at":"2026-08-04T01:16:11.264145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09648","last_updated":"2025-03-12T08:42:05Z","snapshot_observed_at":"2026-08-07T17:10:45.463485Z","submitted_at":"2025-03-12T08:42:05Z","title":"A Survey on Trustworthy LLM Agents: Threats and Countermeasures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09648","snapshot_observed_at":"2026-08-04T01:16:11.444009Z","title":"A survey on trustworthy llm agents: Threats and countermeasures,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.444009Z"},"links":{"cited_paper":"/paper/2503.09648","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:4387237874f2b63831fd44965e7819e5636b250339f905c5a91111a77362138e","observation_id":"ed4c2d9f-cf68-4431-816e-f8271dc0c47a","resolution":{"observed_at":"2026-08-04T01:16:11.444009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.540024Z","title":"Masterkey: Automated jailbreaking of large language model chatbots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.540024Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:e5d71bff515406e181b250b7f6883e9365f11b3912581b2ff1af706c605522f7","observation_id":"b701a1c7-75e3-470a-8697-8a2126d352c8","resolution":{"observed_at":"2026-08-04T01:16:11.540024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.664743Z","title":"Jailbreakzoo: Survey, landscapes, and horizons in jailbreaking large lan- guage and vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.664743Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:cd1be2ace534e752aa2ec0a6887341c31acb285ba55f057624d15f35b293a5e8","observation_id":"9043d682-2db1-45fc-bc51-2d569acad0a4","resolution":{"observed_at":"2026-08-04T01:16:11.664743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.766046Z","title":"Gpt- 4 is too smart to be safe: Stealthy chat with llms via cipher,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.766046Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:1d4b48b1fa4d915c92bfe5e440fa64ff8fba880c8c2875f6c5384375864b527a","observation_id":"1292fb00-17c5-4c13-b6d4-8fd53a9db6bc","resolution":{"observed_at":"2026-08-04T01:16:11.766046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-04T01:16:11.894746Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.894746Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:cfbfedb729138d98fb32ab26c28d27a6f6dccb9bf9af43774b53d8b5b9f65818","observation_id":"e08f1a45-122a-409c-b3b1-99c7d60ad914","resolution":{"observed_at":"2026-08-04T01:16:11.894746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15645","last_updated":"2024-11-03T12:22:30Z","snapshot_observed_at":"2026-08-08T16:20:31.869422Z","submitted_at":"2024-10-21T05:11:19Z","title":"Boosting Jailbreak Transferability for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15645","snapshot_observed_at":"2026-08-04T01:16:12.004751Z","title":"Boosting jailbreak transferability for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.004751Z"},"links":{"cited_paper":"/paper/2410.15645","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c48686d22bd0fcffcc5095b8a2c7136ff22c180236bdb329b6264beedc77d2a6","observation_id":"43d83782-7851-4cf1-97a9-6032f993231a","resolution":{"observed_at":"2026-08-04T01:16:12.004751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-04T01:16:12.144831Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.144831Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:f5039d76129daa2479b1fa3b076c861d036a44fb8e36c9db1f51023baf469e2d","observation_id":"be428ec5-f14b-4543-a2cc-a2b6aab04e02","resolution":{"observed_at":"2026-08-04T01:16:12.144831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-04T01:16:12.245800Z","title":"Deepinception: Hypnotize large language model to be jailbreaker,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.245800Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:ef60e14b76016fac0795cee95fe46b655a67195ee685824a2247a3c68057977e","observation_id":"9481f41b-60c7-4599-9b37-10358127434f","resolution":{"observed_at":"2026-08-04T01:16:12.245800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10619","last_updated":"2025-05-28T09:31:33Z","snapshot_observed_at":"2026-08-07T17:06:11.255557Z","submitted_at":"2025-03-13T17:57:32Z","title":"Tempest: Autonomous Multi-Turn Jailbreaking of Large Language Models with Tree Search","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10619","snapshot_observed_at":"2026-08-04T01:16:12.344757Z","title":"Siege: Autonomous multi-turn jailbreaking of large language models with tree search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.344757Z"},"links":{"cited_paper":"/paper/2503.10619","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:00f501d2b41985d1059e327f6b3e0286a92a2b3a41f33e4fb062f644348c22b4","observation_id":"bec4a2cb-5209-4cbe-9ebe-e9c849fb47d7","resolution":{"observed_at":"2026-08-04T01:16:12.344757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16459","last_updated":"2024-06-06T19:21:44Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T10:03:33Z","title":"Defending LLMs against Jailbreaking Attacks via Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16459","snapshot_observed_at":"2026-08-04T01:16:12.515641Z","title":"Defending llms against jail- breaking attacks via backtranslation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.515641Z"},"links":{"cited_paper":"/paper/2402.16459","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8f0cf3e2ff44b07bf5d685aafae20ae179ca2bfa06ae659f9facf9d87ddb4d7e","observation_id":"5b40f7fa-4ed7-4e8a-ad95-f43854b50ad1","resolution":{"observed_at":"2026-08-04T01:16:12.515641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:12.672284Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.672284Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c14a5ba022d141440732a1feb4a119426e6411138f5d0be6604d2e7689a471b4","observation_id":"d520fa31-9bdf-4ace-9186-f1ddc6454d72","resolution":{"observed_at":"2026-08-04T01:16:12.672284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-06T17:01:00.147032Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-04T01:16:12.719886Z","title":"Red-teaming large language mod- els using chain of utterances for safety-alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.719886Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0f3cfd337fb91123ef33d587370e7627a51739f15d82aad1b98941c193fee896","observation_id":"5aa005cc-1aac-45f5-b27f-407bd964ef24","resolution":{"observed_at":"2026-08-04T01:16:12.719886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:12.788834Z","title":"Attack prompt generation for red teaming and defending large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.788834Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b86faad9374d07c352ab6db47fcba5723a8d4c45189c9dec22a66a975c0ccd9e","observation_id":"7a38e1ad-70e8-40d5-be3d-d16c2fb0d05d","resolution":{"observed_at":"2026-08-04T01:16:12.788834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02855","last_updated":"2025-05-20T05:38:08Z","snapshot_observed_at":"2026-08-10T00:36:05.532472Z","submitted_at":"2024-07-03T07:14:05Z","title":"From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02855","snapshot_observed_at":"2026-08-04T01:16:12.873272Z","title":"Safe unlearning: A surprisingly effective and generalizable solution to defend against jailbreak attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.873272Z"},"links":{"cited_paper":"/paper/2407.02855","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0bc31f590a18d70a682d059390b30c1bfa1a285d454eb724eb955a2de286a5fc","observation_id":"48601139-73e1-473a-ad66-da94405e14d2","resolution":{"observed_at":"2026-08-04T01:16:12.873272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-04T01:16:12.949365Z","title":"Baseline defenses for adversarial attacks against aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.949365Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c42040d7dc24b88c31df14c3f59982a9c5521df9aa031c3cc89717d20357317e","observation_id":"fc595a05-2b83-4101-a1c1-46c4445fa5de","resolution":{"observed_at":"2026-08-04T01:16:12.949365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-07-06T16:15:00.517258Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-04T01:16:13.014747Z","title":"Certifying llm safety against adversarial prompting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.014747Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a3b15da5654ec4c95b52021b4c7c39b9e11c91b3fb7e6eb854435687271efd36","observation_id":"771bd9f5-e888-44a8-a10d-77ae5df37a46","resolution":{"observed_at":"2026-08-04T01:16:13.014747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-04T01:16:13.134915Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.134915Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a6df203aacf92c64f7e747fd81c199367aa827bf91ceddb46c8fd13199aed56a","observation_id":"81cb2df2-f37f-457d-a8d0-16e043624665","resolution":{"observed_at":"2026-08-04T01:16:13.134915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-07-06T16:23:26.584450Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-04T01:16:13.252157Z","title":"Defending against alignment-breaking attacks via robustly aligned llm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.252157Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:35605c9f28015683cc0c944dd85a4b61003902110b0d1d21f6aadb6cfaee15c8","observation_id":"ba8886ca-b654-4e61-8022-fc96553d7efc","resolution":{"observed_at":"2026-08-04T01:16:13.252157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.364750Z","title":"Defending chatgpt against jailbreak attack via self-reminders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.364750Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c0e8614c1c1174ca05c45ad72319e601aa7bb82d2e2a3963813df38858d834ef","observation_id":"9744ff32-f663-4470-a466-7f4a778c6c67","resolution":{"observed_at":"2026-08-04T01:16:13.364750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.535734Z","title":"Steering dialogue dynamics for robustness against multi-turn jailbreaking attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.535734Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:10c645e00d418e3eb5ab3f844ad8ad2829328f032beda1e201b13c945b0c303a","observation_id":"b0ef8a60-ca68-4930-a283-77ed33a62d93","resolution":{"observed_at":"2026-08-04T01:16:13.535734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.651328Z","title":"X-boundary: Establishing exact safety boundary to shield llms from multi-turn jailbreaks without compromising usability,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.651328Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:6726fe9e12cb15a5341c78a25adaaf3787d6239eb6fa4c7082690b0ced083ede","observation_id":"9921ae4a-ca99-4243-9263-0365000a2123","resolution":{"observed_at":"2026-08-04T01:16:13.651328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17458","last_updated":"2025-06-07T08:11:07Z","snapshot_observed_at":"2026-07-06T19:22:27.646571Z","submitted_at":"2024-09-26T01:24:17Z","title":"RED QUEEN: Safeguarding Large Language Models against Concealed Multi-Turn Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17458","snapshot_observed_at":"2026-08-04T01:16:13.794829Z","title":"Red queen: Safeguarding large language models against concealed multi-turn jailbreaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.794829Z"},"links":{"cited_paper":"/paper/2409.17458","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b026ba75b8506122a62affdac2c0fe2df75a8890ca07cd58fc73bcaed8f93dba","observation_id":"b15ac3db-aece-42e1-aa4a-759eb576099d","resolution":{"observed_at":"2026-08-04T01:16:13.794829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.872894Z","title":"Generative agents: Interactive simulacra of human behavior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.872894Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:9022d0af9bfa7879e6ddbc82d761cd5bd61a56622ca4fc184d91cfc95359c92d","observation_id":"1e43c751-4a75-44ae-8c4a-12950bd73985","resolution":{"observed_at":"2026-08-04T01:16:13.872894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16960","last_updated":"2023-10-28T09:02:39Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:17:36Z","title":"Training Socially Aligned Language Models on Simulated Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16960","snapshot_observed_at":"2026-08-04T01:16:13.946073Z","title":"Training socially aligned language models in simulated human society,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.946073Z"},"links":{"cited_paper":"/paper/2305.16960","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:7b4a218bd0fd08b5f9a02902b576a8f5a3a89b7bfeb6203df41cf3499fdb143a","observation_id":"6bb1203a-fa28-45f2-88ae-bd7312b242a7","resolution":{"observed_at":"2026-08-04T01:16:13.946073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.022585Z","title":"Camel: Communicative agents for","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.022585Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a93c5fc4d9778a5cef8532d98e9041fec8b879944b7a03c0843a6397e2329b22","observation_id":"ac613f5c-476e-4f49-936a-dd1cf9cfb4f0","resolution":{"observed_at":"2026-08-04T01:16:14.022585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-08-08T22:28:26.004138Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-04T01:16:14.080163Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.080163Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0313e8f7cb1f229c37f25f9fc4168ff8eb42a2974330b2ac0db29e03cfc79288","observation_id":"8a872541-14d7-4d58-8867-cd96d55ade56","resolution":{"observed_at":"2026-08-04T01:16:14.080163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.172690Z","title":"Metagpt: Meta programming for a multi-agent collaborative framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.172690Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:9aa893fac37d126d425629798afaf709ac7ed4d3d124335933bdf5c0c2dd474f","observation_id":"d3c7f28f-25fa-4bd5-9330-81387c2e42df","resolution":{"observed_at":"2026-08-04T01:16:14.172690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-04T01:16:14.275406Z","title":"Communicative agents for software development,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.275406Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:1753bd88d38c5ed1e6c075df228d858198f431ba4ba93c66d9ac367ba7516661","observation_id":"66ee22d6-3d85-4913-9552-7bfac0e5507c","resolution":{"observed_at":"2026-08-04T01:16:14.275406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-04T01:16:14.424749Z","title":"Improving factuality and reasoning in language models through multiagent debate,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.424749Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:361b1ffafc4e6ab1fa70ed5eea192dd01013f50a70350ee5e771686b8ccf79b9","observation_id":"8892c0c9-d9e9-4521-b8d7-f7b5f9749de4","resolution":{"observed_at":"2026-08-04T01:16:14.424749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-01T16:20:31.337598Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-08-04T01:16:14.553943Z","title":"Encouraging divergent thinking in large language models through multi-agent debate,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.553943Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:5fd6a20a7b8420aeab64237d5ca42ce28b089c35742bf4271abfe145a3c5da30","observation_id":"c713df20-a4d7-48cd-9945-5ffdffa5331d","resolution":{"observed_at":"2026-08-04T01:16:14.553943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.624835Z","title":"Defending large language models against jailbreaking attacks through goal priori- tization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.624835Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:821581e6f2f62ae4789b934a42c98a431d5e7f00e5c0dc116b0cbed4e4a203e2","observation_id":"ccbcfc1e-1960-4ffa-af48-ee77962be44e","resolution":{"observed_at":"2026-08-04T01:16:14.624835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.814826Z","title":"Robust prompt optimization for defend- ing language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.814826Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:63eb5cd51df2f0306078e3546e1585b920d2618911e2593c80c6b865e058b47a","observation_id":"3de10f62-1386-4ca4-9a38-e8c914f54690","resolution":{"observed_at":"2026-08-04T01:16:14.814826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12707","last_updated":"2025-06-15T03:39:13Z","snapshot_observed_at":"2026-08-09T13:13:14.108440Z","submitted_at":"2025-06-15T03:39:13Z","title":"SecurityLingua: Efficient Defense of LLM Jailbreak Attacks via Security-Aware Prompt Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12707","snapshot_observed_at":"2026-08-04T01:16:14.920942Z","title":"Securitylin- gua: Efficient defense of llm jailbreak attacks via security-aware prompt compression,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.920942Z"},"links":{"cited_paper":"/paper/2506.12707","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:008dbc0368b5bc7f7bcc59f7bfad6f3ddc86adcdf58155f86501a6de97b7e0c1","observation_id":"e49c6208-7c87-4509-8609-7c19ad7b1c60","resolution":{"observed_at":"2026-08-04T01:16:14.920942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.024609Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.024609Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:de3ac30f174abf56202375c9f2871c8ff28341a24ff87c38a1e0c49c2abfe903","observation_id":"ad2bd6db-372d-4528-bcb9-99a440857d4b","resolution":{"observed_at":"2026-08-04T01:16:15.024609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.148273Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.148273Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:ceaa7b9eb246ea92258c0e00365556c715a88ea6f9fe70c29e1ac3181350f7c6","observation_id":"cfe5471f-fd88-46ed-a81b-d8486bf54dc1","resolution":{"observed_at":"2026-08-04T01:16:15.148273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.272601Z","title":"M2s: Multi-turn to single-turn jailbreak in red teaming for llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.272601Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:2bfdcbb47fe6842bf977e7f4b9722d9b1f90f1731cf0fb529611925884ce71a3","observation_id":"d2829aa8-a185-4f8d-bd83-8e7ce496b17e","resolution":{"observed_at":"2026-08-04T01:16:15.272601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14762","last_updated":"2024-11-05T16:40:21Z","snapshot_observed_at":"2026-07-06T17:34:07.737296Z","submitted_at":"2024-02-22T18:21:59Z","title":"MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14762","snapshot_observed_at":"2026-08-04T01:16:15.396819Z","title":"Mt-bench-101: A fine-grained benchmark for evaluating large language models in multi-turn dialogues,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.396819Z"},"links":{"cited_paper":"/paper/2402.14762","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:5c89ca55f07e70993cc3928889a2cacce71be38b1a93f1e64e38e02fac6df7fb","observation_id":"0a22fc85-a5fe-456f-b43a-4d89dc2add11","resolution":{"observed_at":"2026-08-04T01:16:15.396819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.489997Z","title":"Cosafe: Evaluating large language model safety in multi-turn dialogue coreference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.489997Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:1acebe6ec4d1c3625793838fadc54170e753007eb4f5481b716b6ab4acd66d09","observation_id":"1702fe08-30d1-48ab-94b9-b7ac696391da","resolution":{"observed_at":"2026-08-04T01:16:15.489997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T20:59:09.642310Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2608.00134."}