{"as_of":"2026-08-10T19:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8fef7e34f5ab17f7f08c9f527c57381bdc537886b0023090e49797cfa8988cc","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:28:54.067424Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.13474/citation-record","integrity":"/paper/2507.13474/integrity","json":"/paper/2507.13474/citation-record.json","paper":"/paper/2507.13474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:48.640057Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:48.640057Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:c53e88c28059a5d5b223b9ec486f1053fa6542dd198b9a6f614ee2d4dc5bbb42","observation_id":"3b31598d-7fe3-4c30-ba6c-7772bfb40a2a","resolution":{"observed_at":"2026-08-06T16:28:48.640057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:48.703778Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:48.703778Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:c3df642c213e1e6faa8a26b82bffedcb02adf306f6958d77f4c36064a03cdf66","observation_id":"c84bf8c5-bd24-48eb-aab1-e0dff72f0958","resolution":{"observed_at":"2026-08-06T16:28:48.703778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:28:48.869873Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:48.869873Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:a105f6e8079972cc801b8ad6ab6cd5428d9800081242881fc217de5c948bb180","observation_id":"236e6eb3-81f5-4e6e-978d-4b077f0e229e","resolution":{"observed_at":"2026-08-06T16:28:48.869873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:48.945367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:48.945367Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:ace4ee834bbbcb39b9d53c50469b973ea11f9361218f8283465fb94343dfa48d","observation_id":"f97162dd-5eda-44e3-879a-59456895e55f","resolution":{"observed_at":"2026-08-06T16:28:48.945367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:56.180038Z","title":null,"venue":null,"work_id":"7f7926a4-59cc-4b70-a99a-188c91d1fb79","year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.077604Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:978b5268d295f55d798428dc1d2a1887d513a183f26afa1f8e0d2f29ac01c059","observation_id":"503487ad-c806-4465-9cce-6055d4bc2ff3","resolution":{"observed_at":"2026-08-06T16:28:56.244127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-07-06T16:10:54.723336Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-06T16:28:49.185819Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.185819Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:717e89395c88416c4ae68b9b761f19fdfa8cc0742c8274222ba904d55b195c3d","observation_id":"347a9bda-f834-4fa3-9990-35be56a60160","resolution":{"observed_at":"2026-08-06T16:28:49.185819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:56.032715Z","title":null,"venue":null,"work_id":"38cb47a7-1626-47f6-ba7b-18213a546f7a","year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.271940Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f44556b4df602b48c07a0695e9c294e3b8eb7820b39eca300f4885537c3c38ea","observation_id":"956382b7-d9de-498f-af1b-1c214190361f","resolution":{"observed_at":"2026-08-06T16:28:56.102262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:55.853156Z","title":null,"venue":null,"work_id":"7cb7f720-2467-400a-92df-65d24f93dc19","year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.402906Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:60664da2e9cfeae9b10e38ab6059ca2321d18aa6f2d2312df554178ed4c5767c","observation_id":"c265d1b5-3cfa-44a5-8c4d-ca081e1e73a2","resolution":{"observed_at":"2026-08-06T16:28:55.933928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T16:28:49.574566Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.574566Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:006c500a211ffc4dfd1bf343a543ef4fc9d139921ffe80ce80eea8ac0021e497","observation_id":"c758b55e-9df9-4e38-8fd8-acaba6266b51","resolution":{"observed_at":"2026-08-06T16:28:49.574566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:55.659232Z","title":null,"venue":null,"work_id":"a1fbe3a5-f3a2-4370-b7c2-bb090624c426","year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.675620Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:ab91be5e2742eb008cd9da143cc5951b8be5263e46bad1ec1768955c25bf105a","observation_id":"8c179423-b704-42b2-a5df-bfe92fa6186e","resolution":{"observed_at":"2026-08-06T16:28:55.742936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-07-06T16:23:26.584450Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-06T16:28:49.811945Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.811945Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:be0c5aed2397ff434ea3bda4ec524bef1fdca7e7adcaa2fe0365ca13ca400939","observation_id":"4b1863eb-3d29-49fb-a8e3-40e0256476e6","resolution":{"observed_at":"2026-08-06T16:28:49.811945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-06T16:28:49.917562Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:49.917562Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:23e6622b9fd719fba74fdbf31b9b025abaccaed98b85783c0c050414f5a77c3b","observation_id":"8e1abffa-02be-423c-8057-9d245034e607","resolution":{"observed_at":"2026-08-06T16:28:49.917562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T16:28:50.068705Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.068705Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:36579df22616f4ce93b235a582e42c1afc8f984f7a4bb5394bd3e783128e33d6","observation_id":"d41ab251-a115-42fd-a0eb-452ae08eb9bb","resolution":{"observed_at":"2026-08-06T16:28:50.068705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:50.163671Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.163671Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:ae0ddafe8785bc412b64607677ab689edc2cfdbec98adbec5cd9028808f98039","observation_id":"91bf5cca-2805-46c2-ab92-d0bbc040feeb","resolution":{"observed_at":"2026-08-06T16:28:50.163671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06083","last_updated":"2019-08-17T18:34:11Z","snapshot_observed_at":"2026-08-08T03:38:10.333686Z","submitted_at":"2019-08-17T18:34:11Z","title":"Build it Break it Fix it for Dialogue Safety: Robustness from Adversarial Human Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06083","snapshot_observed_at":"2026-08-06T16:28:50.247767Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.247767Z"},"links":{"cited_paper":"/paper/1908.06083","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:ca6c52691791798c86347f3c834e330fce7fb4b52be7da9d56f251c4a2e04310","observation_id":"3c10ce6e-2b23-484f-84b6-923160c54a4a","resolution":{"observed_at":"2026-08-06T16:28:50.247767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07689","last_updated":"2023-11-13T19:13:29Z","snapshot_observed_at":"2026-07-06T16:47:01.374736Z","submitted_at":"2023-11-13T19:13:29Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07689","snapshot_observed_at":"2026-08-06T16:28:50.312168Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.312168Z"},"links":{"cited_paper":"/paper/2311.07689","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:53ceb23f91db7fcccfeb3adcff1a264ba0a6884dc3827fdcac0c65f15b422a33","observation_id":"794e5e78-c718-48ad-a1c2-d83518a3af0d","resolution":{"observed_at":"2026-08-06T16:28:50.312168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:28:50.420937Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.420937Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:fe5b2f465fe1842c1621e67aab8b2c866e3b74703dba2e0eeb9fab0126175cf1","observation_id":"7e5b5baf-6437-4902-bdf0-c3a83b46c85d","resolution":{"observed_at":"2026-08-06T16:28:50.420937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T16:28:50.565875Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.565875Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:3d20ae8e6ccf7a1d0c5f3a618b636e227e77e88ebb849ac65a546d19683e5272","observation_id":"210b3c37-d214-4c21-9fc6-bc16dd1be8f5","resolution":{"observed_at":"2026-08-06T16:28:50.565875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:50.707380Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.707380Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:d631a003d17d6466f18486ef5f171bc3f4c3a85d0750ce704d8e421b6b46c83b","observation_id":"b8bb6335-c7c8-4ec4-a734-8546c72d084a","resolution":{"observed_at":"2026-08-06T16:28:50.707380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11753","last_updated":"2024-06-07T17:35:17Z","snapshot_observed_at":"2026-08-10T13:50:03.897892Z","submitted_at":"2024-02-19T00:43:31Z","title":"ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11753","snapshot_observed_at":"2026-08-06T16:28:50.842462Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.842462Z"},"links":{"cited_paper":"/paper/2402.11753","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:dd12459052f3380c5565f50838fdec0a1ae8c2b5d260172b8cadf247d5dae847","observation_id":"a3a0305a-3e57-4a1d-846e-50db95490588","resolution":{"observed_at":"2026-08-06T16:28:50.842462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:55.478291Z","title":null,"venue":null,"work_id":"d8de25b9-e7d7-495d-adf0-af80fe59d319","year":2004},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.971616Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f7fa78200965288656a7243bfd772fc4b108ede76b978f8db6f8bdb4926e574a","observation_id":"c1cbee39-d902-4178-b7e0-cc4dbfe6d414","resolution":{"observed_at":"2026-08-06T16:28:55.556499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:55.304692Z","title":null,"venue":null,"work_id":"873f01fe-1280-4af0-a0e8-6eb58c011d6c","year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.101716Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f0380897edbe7a789a4c16f70b8d1451d403cb44a50455d39774433ec104ea25","observation_id":"ed845802-21d3-4881-823e-906235ed37bc","resolution":{"observed_at":"2026-08-06T16:28:55.373960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-06T16:28:51.241644Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.241644Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:7d467edc69a76fc77408fac756d5cd6e92337cd152ecd19519b836262556b425","observation_id":"896367b5-f986-4cfa-a302-74d89d9b855b","resolution":{"observed_at":"2026-08-06T16:28:51.241644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:55.094596Z","title":null,"venue":null,"work_id":"414b98b5-c367-4385-a82e-1a2670b68033","year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.394418Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:e1a3209776fe858e54d180adef1ec9fd41c2cac837b44eac70429d07e93ad8b0","observation_id":"db972186-50fe-40df-b387-53a0fc9a0b50","resolution":{"observed_at":"2026-08-06T16:28:55.201958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-06T16:28:51.548057Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.548057Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f47e940c54643160487b92df01da35c17952c8acb5346bdc0b4954e9c669429f","observation_id":"611b438e-ffb8-4e54-92a8-7169dbd60563","resolution":{"observed_at":"2026-08-06T16:28:51.548057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:54.927264Z","title":null,"venue":null,"work_id":"5f46106b-e7fc-4f7f-8278-84d3f5773e98","year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.725752Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:e85e830e2debbd252e49411d0aef6de46bdf6a647cf22d773e638978d95ff23a","observation_id":"1f306486-9e95-46ee-b8b1-049df3a4c5b3","resolution":{"observed_at":"2026-08-06T16:28:55.013080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-06T16:28:51.817938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.817938Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f44f8a67204a7d81a74ddee2d82e5ae8a0716dce0653768208b3555ca24d9542","observation_id":"4305db1e-0e1f-4968-af51-2eadbb8c14f9","resolution":{"observed_at":"2026-08-06T16:28:51.817938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:54.750142Z","title":null,"venue":null,"work_id":"3edf5b2f-0cac-4869-ad0f-3c70c5c7dbf6","year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:51.990606Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:2a808a7f49c41dd5e80d29e27f7878885bd32d1c912bed8a828ac41309d1b1a4","observation_id":"5721b676-1875-4f95-9a51-a4b439eac072","resolution":{"observed_at":"2026-08-06T16:28:54.822625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:52.144439Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.144439Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:6d7cfce1beab0c3cf274436591f3fec313903d521ff1310daecf6924c89dc949","observation_id":"7e535475-329a-4045-b5de-6caa0787094f","resolution":{"observed_at":"2026-08-06T16:28:52.144439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:54.527584Z","title":null,"venue":null,"work_id":"a41e30c5-fbf5-44ee-8942-bab05501d619","year":2004},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.240065Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:e5373fae6074bc28849b7dbaf9cee6bac10c7f3db32c426d249f8aadfc83b421","observation_id":"ae2ceb50-aa3a-48a1-8e3f-19eb9ac38a2b","resolution":{"observed_at":"2026-08-06T16:28:54.642109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-06T16:28:52.360605Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.360605Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:b345d8868ef48091c22595919c4a2cb7733c419ca6fe2e14f3d35969ae1149bf","observation_id":"fbf7b2ac-b8c5-4d43-bd13-dc47513b9fa4","resolution":{"observed_at":"2026-08-06T16:28:52.360605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:52.493755Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.493755Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:4f22022bb2f1baf8642a1d95157871092807f29c555798919bf2ce17b348d34c","observation_id":"c75b6dba-86ac-4d4b-bb3e-a676cd000403","resolution":{"observed_at":"2026-08-06T16:28:52.493755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-06T16:28:52.637985Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.637985Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:cd9c6a9a8906ae504b2b5cde5aa424405ad734e3cdd353488d91e2465a0f9c1d","observation_id":"f382b434-c798-4cb9-b749-214729b7cb5d","resolution":{"observed_at":"2026-08-06T16:28:52.637985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-06T16:28:52.739133Z","title":"do anything now","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.739133Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:1f3a0c66e4b94704c2157135cf78e77faf99b1e9bf6abaedce99642e48e66be6","observation_id":"d2e988a5-2a3d-4bb2-ace0-6d9abfe43f2a","resolution":{"observed_at":"2026-08-06T16:28:52.739133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T16:28:52.931076Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:52.931076Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:bc08fb78886ae4e08279815ed553c2e1c76d8fb92f64177ccaf83f892460932f","observation_id":"df9224f7-33de-4564-b168-9ec5247baa30","resolution":{"observed_at":"2026-08-06T16:28:52.931076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:28:54.329104Z","title":null,"venue":null,"work_id":"bf4450c0-2aec-420b-bebc-a30860c84bfc","year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.032268Z"},"links":{"citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:5a0ad85f689ce63fb0f70589c606c013e73e2f0956df33b6d8b75402c8e95806","observation_id":"3e363830-d5e3-45cf-be3e-9474bdea96c6","resolution":{"observed_at":"2026-08-06T16:28:54.416687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-06T16:28:53.214889Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.214889Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:f1e338aaacb22f4a66c415495183641ced9725d3a7818dd9ec1bc742e68e477d","observation_id":"e2115a4e-2767-4e58-a3ca-b627164c590e","resolution":{"observed_at":"2026-08-06T16:28:53.214889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-06T16:28:53.364399Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.364399Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:8c90e1f39844db6ed34b496500252e265242ae0e905dfd4746ef88f01e4b6145","observation_id":"cf851105-cb94-44f7-b922-4c0c5690b70d","resolution":{"observed_at":"2026-08-06T16:28:53.364399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-06T16:28:53.451033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.451033Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:737a2dfc2f598cadfe6d77c341e6b99c6c6881b596f0a911478d83cbc3f92ef4","observation_id":"a938959c-9abd-4204-8835-ff1968fc4e5d","resolution":{"observed_at":"2026-08-06T16:28:53.451033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-08-10T11:13:59.778209Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-06T16:28:53.616114Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.616114Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:e81bfa4ee198bd0aa5c9c39460433702c6e5d5556d3ae534ce03f70a6a8a4e93","observation_id":"4fd72723-3dd6-45be-8ceb-8ac186636391","resolution":{"observed_at":"2026-08-06T16:28:53.616114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10766","last_updated":"2025-03-15T00:49:45Z","snapshot_observed_at":"2026-07-06T17:04:17.738921Z","submitted_at":"2023-12-17T17:02:14Z","title":"JailGuard: A Universal Detection Framework for LLM Prompt-based Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10766","snapshot_observed_at":"2026-08-06T16:28:53.745955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.745955Z"},"links":{"cited_paper":"/paper/2312.10766","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:1a263c17b13cf1f7e1272eded442741897add1e4adc96d5c4ab98bdecaea216e","observation_id":"ff35eece-cd72-4c90-8265-2c4068223693","resolution":{"observed_at":"2026-08-06T16:28:53.745955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-10T08:43:09.448466Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-06T16:28:53.895617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.895617Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:6e7c546f5fe9f2b0d4113a53e92b4675cdf4f7799c7fc774094a139656f60d68","observation_id":"51d00b66-1e49-4927-b73b-35dfe637e7e1","resolution":{"observed_at":"2026-08-06T16:28:53.895617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T16:28:54.067424Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:54.067424Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:663e0bb7f7b416bc12eec8a9d716405460ed653dc7dbdf3dcdb3ae586a9036b4","observation_id":"6b688f2f-1418-4268-8b2c-054e0d455c8b","resolution":{"observed_at":"2026-08-06T16:28:54.067424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2507.13474."}