{"as_of":"2026-08-12T14:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:abd359820b0df8649c032e43826f3bc021d590acbad09993591beed9bd95808e","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:48:19.918679Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T09:21:57.373862Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:16:34.678418Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"cited_work":{"arxiv_id":"2505.17598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17598","snapshot_observed_at":"2026-07-02T04:16:34.678418Z","title":"One model transfer to all: On robust jailbreak prompts generation against llms","venue":null,"work_id":"d5c100c7-b473-45c7-8d1f-37da1d1ba596","year":2025},"citing_paper":{"arxiv_id":"2604.10326","last_updated":"2026-04-11T19:19:05Z","snapshot_observed_at":"2026-08-10T21:17:10.678182Z","submitted_at":"2026-04-11T19:19:05Z","title":"Jailbreaking the Matrix: Nullspace Steering for Controlled Model Subversion","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T15:19:46.920899Z"},"links":{"cited_paper":"/paper/2505.17598","citing_paper":"/paper/2604.10326"},"observation_digest":"sha256:17463791f931b08c1ad3bf34ed3725c1794602ec5684d5ddf89d9a1d9b2a3ade","observation_id":"46d50d66-226e-4c0b-8b8c-1180341e32c7","resolution":{"observed_at":"2026-05-11T10:46:04.279470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"cited_work":{"arxiv_id":"2505.17598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17598","snapshot_observed_at":"2026-07-02T04:16:34.678418Z","title":"One model transfer to all: On robust jailbreak prompts generation against llms","venue":null,"work_id":"d5c100c7-b473-45c7-8d1f-37da1d1ba596","year":2025},"citing_paper":{"arxiv_id":"2606.03647","last_updated":"2026-06-02T13:39:15Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T13:39:15Z","title":"Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable... Attacks Are All You Need to Break LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T09:21:57.373862Z"},"links":{"cited_paper":"/paper/2505.17598","citing_paper":"/paper/2606.03647"},"observation_digest":"sha256:839ae9e33ca8ab5a45a873d66a86bb4473b0ce4b79535eb992fe7531e31d4363","observation_id":"aa48eac5-0c31-4905-8582-1f303c47d7bb","resolution":{"observed_at":"2026-07-02T04:16:34.680474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17598/citation-record","integrity":"/paper/2505.17598/integrity","json":"/paper/2505.17598/citation-record.json","paper":"/paper/2505.17598"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:15.617814Z","title":"The claude 3 model family: Opus, sonnet, haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.617814Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c36d6c6a8d777b65cba5873f04629327f38aa140dde5c7f034bcd07b6a16b1fd","observation_id":"9be110d1-22af-492c-9931-f8253c1d3990","resolution":{"observed_at":"2026-08-07T14:48:15.617814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.717241Z","title":"Safety-tuned LL a MA s: Lessons from improving the safety of large language models that follow instructions","venue":null,"work_id":"3bfc68c2-9037-4cf8-b2c6-0394016126d1","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.699936Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:41e89dd3af398d6218865091230575b67041ce75aa1deaeb2aa97fedc37d2471","observation_id":"e1a85fe0-6a60-411b-86a9-285e8ad8e8df","resolution":{"observed_at":"2026-08-07T14:48:22.788715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:15.759195Z","title":"Are aligned neural networks adversarially aligned? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.759195Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e50569216596cd2080ad42d6b0acdee3c5522af42acbb53fb40104b5b5bd51ed","observation_id":"f15deae1-c7e5-4e8b-abe8-1c4010af6d98","resolution":{"observed_at":"2026-08-07T14:48:15.759195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-12T12:29:45.113982Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T14:48:15.829373Z","title":"Jailbreaking black box large language models in twenty queries","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.829373Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:f14281f88d22675cefe2650de2613f7588e31c6ee4f46651c274ee11172cf9ff","observation_id":"e91f13cf-5392-4bdb-b221-f3273a0e1237","resolution":{"observed_at":"2026-08-07T14:48:15.829373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T14:48:15.972755Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.972755Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:f223986de4dc4b3a9214a73fb3e448f0d840c978aacdab0a29414fb16eea1182","observation_id":"5826d2a9-04e2-4dee-8cdc-cea0af0cf480","resolution":{"observed_at":"2026-08-07T14:48:15.972755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.556996Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90\\ See https://vicuna","venue":null,"work_id":"f6831329-a744-46a6-90b2-528bf6eca5b0","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.019150Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:1949029b1399994daae44e914f99d9b0d4ec91671404a3086ec36a37add793f8","observation_id":"b5458565-1d25-4f62-82d3-52d3ca8d7aff","resolution":{"observed_at":"2026-08-07T14:48:22.623182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.446638Z","title":"Selection-inference: Exploiting large language models for interpretable logical reasoning","venue":null,"work_id":"6077100e-aec3-44de-816e-a0cb40c3d848","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.058162Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:b88c92def1847b811c363dbe1bc3c949af4121ac950bbd8726762592c9d1cce0","observation_id":"3f756724-bf09-463c-9e32-b9ffd3f91a58","resolution":{"observed_at":"2026-08-07T14:48:22.494668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:16.173397Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.173397Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:979874cbb3f3b51b56d57f694c76585a8fbaf0f38511e89626f3d045827aacf0","observation_id":"38d415ed-b90a-4dce-8725-81d90569c186","resolution":{"observed_at":"2026-08-07T14:48:16.173397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.279231Z","title":"A wolf in sheep ' s clothing: Generalized nested jailbreak prompts can fool large language models easily","venue":null,"work_id":"442b72da-39d7-413e-a50f-22b2f195b364","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.271254Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:d862a4157e0a14aeb0e8bfc4f4b290418c11c6d3d6a29a0a954958f32eb21bb2","observation_id":"0b915e4e-f657-4a4d-a734-da761997e85e","resolution":{"observed_at":"2026-08-07T14:48:22.330055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-07T14:48:16.356727Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.356727Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:7028a3c37787eacd533e5e88ced167657185454bdb5ad7cb472c209c0db233dc","observation_id":"408ace67-dd89-4f62-ab08-1832acbcf9f0","resolution":{"observed_at":"2026-08-07T14:48:16.356727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16192","last_updated":"2024-02-28T23:11:33Z","snapshot_observed_at":"2026-08-09T20:10:52.906428Z","submitted_at":"2024-02-25T20:36:03Z","title":"Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16192","snapshot_observed_at":"2026-08-07T14:48:16.431715Z","title":"Defending large language models against jailbreak attacks via semantic smoothing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.431715Z"},"links":{"cited_paper":"/paper/2402.16192","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:732a19c4aea81d0fa5bf0bbc161016b5bb159b5811880007215e8b5fffb4b2b9","observation_id":"cd90a318-fbaa-4d84-af95-b6006dfb8448","resolution":{"observed_at":"2026-08-07T14:48:16.431715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21018","last_updated":"2024-06-05T16:35:49Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T17:07:15Z","title":"Improved Techniques for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21018","snapshot_observed_at":"2026-08-07T14:48:16.511497Z","title":"Improved techniques for optimization-based jailbreaking on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.511497Z"},"links":{"cited_paper":"/paper/2405.21018","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e54ceec1cba8e198762485019d9b75da2bc0ba4c8ab3a1032ca5b2247702676e","observation_id":"918cc513-33f3-4b45-aa54-b057d3f459f3","resolution":{"observed_at":"2026-08-07T14:48:16.511497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12935","last_updated":"2025-01-07T04:42:20Z","snapshot_observed_at":"2026-07-06T18:33:15.701836Z","submitted_at":"2024-06-17T03:03:34Z","title":"ChatBug: A Common Vulnerability of Aligned LLMs Induced by Chat Templates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12935","snapshot_observed_at":"2026-08-07T14:48:16.637249Z","title":"Chatbug: A common vulnerability of aligned llms induced by chat templates","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.637249Z"},"links":{"cited_paper":"/paper/2406.12935","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e9b517eef8ef674c32188d22cde45d001ecfded6bc3323438ac66348a56ad565","observation_id":"73ac51c4-1e90-43ab-99d7-f2ef63c98c63","resolution":{"observed_at":"2026-08-07T14:48:16.637249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:16.715057Z","title":"Pretraining language models with human preferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.715057Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e3d6cb209680d737eea8cdb5868d0805704bff2eb633b5e5732df30b893095c4","observation_id":"5936518c-8597-4575-b8f6-130a68ae89a7","resolution":{"observed_at":"2026-08-07T14:48:16.715057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14872","last_updated":"2024-02-27T13:49:22Z","snapshot_observed_at":"2026-08-12T12:44:43.683069Z","submitted_at":"2024-02-21T15:13:50Z","title":"Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14872","snapshot_observed_at":"2026-08-07T14:48:16.796826Z","title":"Semantic mirror jailbreak: Genetic algorithm based jailbreak prompts against open-source llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.796826Z"},"links":{"cited_paper":"/paper/2402.14872","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:3adecd1246a9a77d8c0dd8c88a2db0b5f1a34e9cb83e81e0a3f683de4b442a16","observation_id":"e4abee56-3d46-4a49-9a63-5ced7a6e294e","resolution":{"observed_at":"2026-08-07T14:48:16.796826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-08-11T18:59:56.759207Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-07T14:48:16.908261Z","title":"Drattack: Prompt decomposition and reconstruction makes powerful llm jailbreakers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.908261Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:51ed5a7e58c3baa87564e8f5f1dbd2a2cacfd48ea7985e9b56bdff45c8620b66","observation_id":"9ed957d2-2887-409b-bdcb-8842dc65627e","resolution":{"observed_at":"2026-08-07T14:48:16.908261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-07T14:48:17.045904Z","title":"Deepinception: Hypnotize large language model to be jailbreaker","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.045904Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:87377ed797ad2920931abb4e2699b87dbb814a484805c456b21ff85a37ab4a21","observation_id":"ddd664fb-f6f8-4189-b45d-15adea217f73","resolution":{"observed_at":"2026-08-07T14:48:17.045904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-10T23:27:47.484934Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-07T14:48:17.137451Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.137451Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:2f1dab16d3204c7eeb8190de933f3491065d8fee61e96bbf66a765651e49332f","observation_id":"aeaa5a8a-e36d-4082-b248-a403c076f259","resolution":{"observed_at":"2026-08-07T14:48:17.137451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.150637Z","title":"Auto DAN : Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":"d5dca74f-2306-4af7-abb4-4413c7222af5","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.268725Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:50013f5a2b79f376191eb6d00b1369572af092117c7e910e798071c8f714bafd","observation_id":"b8cc7319-4458-4b15-b79e-2996f06399bd","resolution":{"observed_at":"2026-08-07T14:48:22.202201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-08-10T11:33:27.635491Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T14:48:17.350033Z","title":"Codechameleon: Personalized encryption framework for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.350033Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:555b5c8d2f9049717ba5d5269ccfd70fe2bd6702c337428cdda11de1b3a57da2","observation_id":"bf238e03-c2f9-492c-ae66-27c1804f362a","resolution":{"observed_at":"2026-08-07T14:48:17.350033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.956728Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"1e459bda-b03d-43a5-88b8-3feb6c60221f","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.424186Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e6355e681bfa01d97c5f5cc9853858eec220c2c3fea43486c3cb9a889ce183a8","observation_id":"2304a90e-8258-4faa-9238-a1127b9121ab","resolution":{"observed_at":"2026-08-07T14:48:22.050501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.824943Z","title":"Tree of attacks: Jailbreaking black-box LLM s automatically","venue":null,"work_id":"aa5d4e4e-6486-4e01-9ae1-eb5b41f3df82","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.504179Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:09495f25bba44cb9360888b83676727be06a04dbc469c6675b9d687eadd3aff5","observation_id":"02d8d6aa-cf37-4c38-8d34-4e8c8197181c","resolution":{"observed_at":"2026-08-07T14:48:21.862525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.675822Z","title":"Fight back against jailbreaking via prompt adversarial tuning","venue":null,"work_id":"e0c81ad6-6f56-442b-952f-0252c8bd1ec5","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.583940Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:20e29faba845eb498a3aef46a8fb88f176973248214cf8b0c368e4c1bffc8caa","observation_id":"17228427-d4b0-4f0b-8a23-f9a79b307f2e","resolution":{"observed_at":"2026-08-07T14:48:21.765165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.529361Z","title":"Snapshot of gpt-3.5-turbo from march 1st 2023","venue":null,"work_id":"9d1338ed-1220-4c97-840f-1f2e7d9f2887","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.650839Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:f8abc71dbe2b6349903df034ae08c106c4ee6a811ecc295fa8aaddce45a98dc4","observation_id":"2e4ed94e-d0a7-412e-9bbc-189c10aee2c6","resolution":{"observed_at":"2026-08-07T14:48:21.612033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.386546Z","title":"Gpt-4 technical report, 2023 b","venue":null,"work_id":"04707c14-0f27-4cca-bc46-0b2de7cdb662","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.757745Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:582adcc85fe2ac3ea3c35d70864ff6a1d288f9eb67719fffbef5d713f21ca120","observation_id":"acabc645-673f-4d89-9202-2fdc53bb488c","resolution":{"observed_at":"2026-08-07T14:48:21.479567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:17.865297Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.865297Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:efb5067e0b7cbc51e9156e5e78fd1b99bcbc363f9223152c2a3a903ffef96ad9","observation_id":"68efa101-8578-4541-ac48-7954ff509fd3","resolution":{"observed_at":"2026-08-07T14:48:17.865297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.194747Z","title":"Red teaming language models with language models","venue":null,"work_id":"122e39e1-4479-4566-a23b-3b79e69c7620","year":2022},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.958546Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a05e74526793f0ec5f6b4d59b2815a6cfd102ca5f0e623a2378a093904baae4e","observation_id":"a1b439b1-373a-4894-9d43-570f3fc5a749","resolution":{"observed_at":"2026-08-07T14:48:21.255103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.023530Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.023530Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:b733880a6f8c642125b62edf03708e494d994be54bf5e7fc5e518a31c2895db6","observation_id":"d23f52bd-4ca5-436e-8c3e-fdb6e77fd748","resolution":{"observed_at":"2026-08-07T14:48:18.023530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T14:48:18.126499Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.126499Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:91ade973b5aaf456a48701abed09ae19d9c8ed664a07b03730edd91120ddb87c","observation_id":"7e846e3d-3986-4b22-8b9d-2d3536159e8e","resolution":{"observed_at":"2026-08-07T14:48:18.126499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.206720Z","title":"All in how you ask for it: Simple black-box method for jailbreak attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.206720Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:26d9febc848a31de7fcf7792fd676ae16fe6ea065b07244d72fa9495c2fa5f9f","observation_id":"528b4f7c-efa5-4ffe-8670-963e8e0dc931","resolution":{"observed_at":"2026-08-07T14:48:18.206720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:48:18.262919Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.262919Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a58b66b99a432d96d09d77239fe0792ff67ac751b87a27d01a696ffa20bce00d","observation_id":"c4d9d5f7-4adc-4145-b18d-77eaef25c03c","resolution":{"observed_at":"2026-08-07T14:48:18.262919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-11T19:09:11.098841Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-07T14:48:18.341107Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.341107Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:48c2d2b79d722b973c5c2f13a99ad094f15c3791720e346200324076756c4671","observation_id":"609374de-bfb4-44d8-8669-6b56623f2efb","resolution":{"observed_at":"2026-08-07T14:48:18.341107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.427408Z","title":"Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.427408Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:10533c029d8c460350f5b1fed985a8d1e9b435c5c436f61fcaf5f869d98660c6","observation_id":"c36690dc-aa9e-4741-acf3-4065a55dbbf1","resolution":{"observed_at":"2026-08-07T14:48:18.427408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09127","last_updated":"2024-01-20T18:55:51Z","snapshot_observed_at":"2026-08-12T11:45:13.491242Z","submitted_at":"2023-11-15T17:17:39Z","title":"Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09127","snapshot_observed_at":"2026-08-07T14:48:18.483319Z","title":"Jailbreaking gpt-4v via self-adversarial attacks with system prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.483319Z"},"links":{"cited_paper":"/paper/2311.09127","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:9bca8dde337ba296ae7a46256b4f52668bd300d6c00511a82a1a1d94144a5f87","observation_id":"77d3c26e-d3d3-4b02-ba96-47104965f923","resolution":{"observed_at":"2026-08-07T14:48:18.483319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20099","last_updated":"2025-06-04T02:59:37Z","snapshot_observed_at":"2026-08-10T13:19:12.453641Z","submitted_at":"2024-05-30T14:40:35Z","title":"Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20099","snapshot_observed_at":"2026-08-07T14:48:18.627766Z","title":"Defensive prompt patch: A robust and interpretable defense of llms against jailbreak attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.627766Z"},"links":{"cited_paper":"/paper/2405.20099","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:eb1dfa8fd9c2ba102adbb1beb604a69b640cd6376f6693d65e2d76abeecd6876","observation_id":"a5dde6f0-a376-49b4-8038-159cbddccc4f","resolution":{"observed_at":"2026-08-07T14:48:18.627766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.997636Z","title":"Safedecoding: Defending against jailbreak attacks via safety-aware decoding","venue":null,"work_id":"e91a6953-9edc-4764-a4a0-5b223be6687e","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.710971Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:1956268a1d406334acafa1b89d3f2fa46d5b5bc6b5b6fb35d1383cb162009496","observation_id":"04a3ae29-f7e2-4cdd-95a4-35d10a75d655","resolution":{"observed_at":"2026-08-07T14:48:21.088976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09324","last_updated":"2024-11-06T04:43:57Z","snapshot_observed_at":"2026-08-11T17:10:02.260009Z","submitted_at":"2024-06-13T17:01:40Z","title":"Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09324","snapshot_observed_at":"2026-08-07T14:48:18.758264Z","title":"Bag of tricks: Benchmarking of jailbreak attacks on llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.758264Z"},"links":{"cited_paper":"/paper/2406.09324","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:82fc4dff98d31a5ef8cd7b620fddfffe6dd197e4b9616bfc6a88d2af3e6806af","observation_id":"17efba1d-e493-4593-9413-d13bedbf7dbd","resolution":{"observed_at":"2026-08-07T14:48:18.758264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T14:48:18.798279Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.798279Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:99f4237515caff8e99afce1ec45220435890f2c28e7ffe693de8f904dc0b0ceb","observation_id":"22469730-0548-4f43-9834-ff7767665d82","resolution":{"observed_at":"2026-08-07T14:48:18.798279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00286","last_updated":"2023-12-10T13:58:24Z","snapshot_observed_at":"2026-08-09T00:19:55.817204Z","submitted_at":"2023-11-01T04:36:45Z","title":"JADE: A Linguistics-based Safety Evaluation Platform for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00286","snapshot_observed_at":"2026-08-07T14:48:18.912188Z","title":"Jade: A linguistics-based safety evaluation platform for llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.912188Z"},"links":{"cited_paper":"/paper/2311.00286","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:59a1e42c3d6727418e845a5741e0b25868509eea3ed4f2cca4f769f2d3a33de0","observation_id":"69334d55-1a3f-464a-9983-23534f772871","resolution":{"observed_at":"2026-08-07T14:48:18.912188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.994663Z","title":"Instruction tuning for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.994663Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a132eb342842a46db3fa6d0633e95eb31bcc43618a9645f2d8df91f3500e5c05","observation_id":"d81e1812-e9bd-491f-b1c1-38c5021983f9","resolution":{"observed_at":"2026-08-07T14:48:18.994663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.904416Z","title":"Boosting jailbreak attack with momentum","venue":null,"work_id":"7ecc7000-86ab-486e-8876-30d3e4fca700","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.065101Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:6abe5c50a3d373ea7c8b8d92e6be2978b875fa24d88e45fe114b7594dab040bb","observation_id":"e12c41e2-6819-4e02-910f-74c7d0eb0f50","resolution":{"observed_at":"2026-08-07T14:48:20.944684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01251","last_updated":"2024-11-08T06:07:51Z","snapshot_observed_at":"2026-07-06T17:38:38.108579Z","submitted_at":"2024-03-02T16:23:44Z","title":"Accelerating Greedy Coordinate Gradient and General Prompt Optimization via Probe Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01251","snapshot_observed_at":"2026-08-07T14:48:19.161847Z","title":"Accelerating greedy coordinate gradient via probe sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.161847Z"},"links":{"cited_paper":"/paper/2403.01251","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:ca6a287709a3ffddec4f4e688c8944a24b082357537989e4a89ca5d588b58e48","observation_id":"81ad2ebf-cefc-41f9-9e41-35f614470b81","resolution":{"observed_at":"2026-08-07T14:48:19.161847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17568","last_updated":"2024-07-10T03:52:58Z","snapshot_observed_at":"2026-07-06T15:10:12.213443Z","submitted_at":"2023-03-30T17:34:01Z","title":"CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17568","snapshot_observed_at":"2026-08-07T14:48:19.249678Z","title":"Codegeex: A pre-trained model for code generation with multilingual evaluations on humaneval-x","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.249678Z"},"links":{"cited_paper":"/paper/2303.17568","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:33bf1867f0c8d11883b3e09597cf74decaa6d5f8d96fed03a765ae6c388a9d85","observation_id":"19be7a68-208f-49fa-9f69-19f6108d4d59","resolution":{"observed_at":"2026-08-07T14:48:19.249678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.739434Z","title":"Robust prompt optimization for defending language models against jailbreaking attacks","venue":null,"work_id":"29a02bb7-4efa-49b5-b24b-49274c93c18a","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.359882Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:34d3395a1955d7e304fd7c90b4c38b03e0fa2fd1461cbb12ad1a977429bb6092","observation_id":"161fdb6c-d5b6-4790-9aa6-510d377279ce","resolution":{"observed_at":"2026-08-07T14:48:20.834533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.609755Z","title":"Auto DAN : Interpretable gradient-based adversarial attacks on large language models","venue":null,"work_id":"28e9dc6d-86b8-4efc-828b-4a9867aa6cbc","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.421019Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:91f0111507bc2c660c767cf8ce0c5f163b98d35efd8f4ec80a34f83f9c671554","observation_id":"6cc63926-d7fa-499c-9d4c-e5013cc51127","resolution":{"observed_at":"2026-08-07T14:48:20.651337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.455610Z","title":"Toolqa: A dataset for llm question answering with external tools","venue":null,"work_id":"49faf533-9b54-40a8-a911-b730977bd79a","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.477699Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:18dc230e3f98f6dbf92e115e1d84bc140dd0157f6b2cf0c75e2df49fec07514d","observation_id":"49a229ff-004e-4c39-928d-e2216b637aff","resolution":{"observed_at":"2026-08-07T14:48:20.549914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T14:48:19.585178Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.585178Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:cce0c8d286d6c579e0ac5a3aad392a419910b68963317f0e9355423db9743180","observation_id":"333d6902-87b6-4470-85e4-59b3582d147d","resolution":{"observed_at":"2026-08-07T14:48:19.585178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.695447Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.695447Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:9c78c7eff7e8869cde19b7f07263479d78373f393857d170b60b2d42b5216bb1","observation_id":"38ebce12-0746-4952-998c-0d87a844b871","resolution":{"observed_at":"2026-08-07T14:48:19.695447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.755580Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.755580Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:8955516f0cd29df367cc98619b668c84d655a7959f11e219017c1298962ecbb6","observation_id":"1749b9e1-2346-4049-bc1c-48a9f287426b","resolution":{"observed_at":"2026-08-07T14:48:19.755580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.815959Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.815959Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:317701dfdde526e458239b49156c0cbfc1fe0cf367524ce2eb6bc8637f4b256e","observation_id":"d21e31e3-1391-41f2-b9a5-1688a76abfea","resolution":{"observed_at":"2026-08-07T14:48:19.815959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.918679Z","title":"1zMx:sy;[c݅ EƐ uqmqpN <Q jL . yTWVU+ MϫQ= U>s:4K I )?,˖?. ٨S/M G+2 -.Zy X ʛ Cc.M @/HB 60Hqv _A ` 㵸YCZ 6pQnm 9yI","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.918679Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a984671e45d9da43507e9893dbd25fec0dfd45c486aa48870e9381a01d91740a","observation_id":"78124580-7b17-4804-a32f-f3dac5904765","resolution":{"observed_at":"2026-08-07T14:48:19.918679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-11T05:34:33.472335Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2505.17598."}