{"as_of":"2026-08-11T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f53101c125e0932d3dd9bfcd0a07d57b3f7ce053c8d0df39348f430ff01cc069","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:02:31.476445Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T17:49:42.112564Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T17:51:41.877221Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"cited_work":{"arxiv_id":"2506.12274","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12274","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0a407a0b-cdc5-407d-b2e2-8b26b43f288b","year":2025},"citing_paper":{"arxiv_id":"2509.10546","last_updated":"2026-04-24T18:29:01Z","snapshot_observed_at":"2026-08-02T04:58:06.974646Z","submitted_at":"2025-09-07T22:35:15Z","title":"Learning to Conceal Risk: Controllable Multi-turn Red Teaming for LLMs in the Financial Domain","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-18T17:49:42.112564Z"},"links":{"cited_paper":"/paper/2506.12274","citing_paper":"/paper/2509.10546"},"observation_digest":"sha256:479a2adae7921d1158595e95845976660c7a37bdbc4404bcccfcdd6c9bafb7c4","observation_id":"37cb36f4-60e7-476b-856c-01c913c0bbe7","resolution":{"observed_at":"2026-05-18T17:51:41.879269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12274/citation-record","integrity":"/paper/2506.12274/integrity","json":"/paper/2506.12274/citation-record.json","paper":"/paper/2506.12274"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:27.992361Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:27.992361Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:f5e64ffc30bccaff5d923b6531eb51f0aacbdaab239af2a6cff1c0f7060817c0","observation_id":"4599e56b-8c40-45b2-b42c-c3dafba462cb","resolution":{"observed_at":"2026-08-07T01:02:27.992361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:28.089322Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.089322Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:68ee97d8a66988dac0fae4fa95f110eb5c158efcd629286075910b3b99261f4a","observation_id":"b590bac7-7219-4e38-9bad-ab644bc47292","resolution":{"observed_at":"2026-08-07T01:02:28.089322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11969","last_updated":"2025-04-17T18:36:08Z","snapshot_observed_at":"2026-08-10T11:13:15.103497Z","submitted_at":"2024-07-16T17:59:55Z","title":"Does Refusal Training in LLMs Generalize to the Past Tense?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11969","snapshot_observed_at":"2026-08-07T01:02:28.139129Z","title":"Does refusal training in llms generalize to the past tense?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.139129Z"},"links":{"cited_paper":"/paper/2407.11969","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:6c1a86530fe40674411d3f280e989769e5a1df6e51f185b5a96722d5534ef836","observation_id":"fb56c737-8c7e-4b8b-a525-fc7ba42f9a2f","resolution":{"observed_at":"2026-08-07T01:02:28.139129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-10T11:04:18.421023Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-07T01:02:28.219255Z","title":"Jailbreaking leading safety-aligned llms with simple adaptive attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.219255Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:4df3eafdcc89ef56be2f32250adbd5cd74c1aa7d51f8b2028ccecbcedaac49ce","observation_id":"45f4c9b1-61f6-4c56-ac0e-972d3aa5399b","resolution":{"observed_at":"2026-08-07T01:02:28.219255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T01:02:28.245895Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.245895Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:674a5bfa03ad6baabb130904973404ffb2717a5acb7eaf72767ea59c93a54a02","observation_id":"9955a0d8-e12a-4bdc-96fc-35040173a9e6","resolution":{"observed_at":"2026-08-07T01:02:28.245895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T01:02:28.336517Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.336517Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:a041eeb32290edfb32bee9dae24c11cf7441cf1112e6b9fc832bf7da3291a520","observation_id":"73515443-fb14-4a2c-a2b8-88982c43a6ba","resolution":{"observed_at":"2026-08-07T01:02:28.336517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T01:02:28.376924Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.376924Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:208681e3992feda83fdf331baadda7280ccedb1fd9da4d81cdfa004daf64fa3d","observation_id":"a2e4e2fe-c1aa-4c48-88da-f4468050bfcd","resolution":{"observed_at":"2026-08-07T01:02:28.376924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-10T23:28:02.754591Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T01:02:28.442955Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.442955Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:5d068450b2ed5fc980f43627881ce678a11b5c5b5b137f4c07ff1a25f16bd79b","observation_id":"92da5a23-91f1-46d2-80c5-233ed4293158","resolution":{"observed_at":"2026-08-07T01:02:28.442955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06083","last_updated":"2019-08-17T18:34:11Z","snapshot_observed_at":"2026-08-08T03:38:10.333686Z","submitted_at":"2019-08-17T18:34:11Z","title":"Build it Break it Fix it for Dialogue Safety: Robustness from Adversarial Human Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06083","snapshot_observed_at":"2026-08-07T01:02:28.494126Z","title":"Build it break it fix it for dialogue safety: Robustness from adversarial human attack, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.494126Z"},"links":{"cited_paper":"/paper/1908.06083","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:6ab77bf6c0e5d3bd4354b021097f3b63986be9a95c2ba9e8d01bc02d7ae920dc","observation_id":"574d3678-30ed-4795-905f-b9ba33de1454","resolution":{"observed_at":"2026-08-07T01:02:28.494126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.727444Z","title":"Google gemini flash, February 2025","venue":null,"work_id":"7a1e5c14-4147-473e-b3bd-2f80162afbd8","year":2025},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.542208Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:cf4f9e94378d50d43f6b1aa2ec13afd71c3dc8e90af2631f5ad4f7cd38e4c503","observation_id":"473d0749-0446-4e7d-975c-e4f8cee67e56","resolution":{"observed_at":"2026-08-07T01:02:32.804000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-08-11T10:38:35.302365Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-07T01:02:28.553458Z","title":"Deliberative alignment: Reasoning enables safer language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.553458Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:330638cb6f41a18fa863bce4aa27001a8ad6956013c550b659d401b22905453a","observation_id":"a952a564-86e3-4215-84b1-0e5002fc8b9b","resolution":{"observed_at":"2026-08-07T01:02:28.553458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01294","last_updated":"2025-05-10T19:38:13Z","snapshot_observed_at":"2026-08-08T20:47:41.527838Z","submitted_at":"2024-10-02T07:40:56Z","title":"Endless Jailbreaks with Bijection Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01294","snapshot_observed_at":"2026-08-07T01:02:28.608823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.608823Z"},"links":{"cited_paper":"/paper/2410.01294","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0f7156219659b76583528d2de0f06eb4abf9211e36b95546e85cbf3fd58d23cc","observation_id":"883e1bf8-fe66-41cd-a0e0-11ef0faf44fc","resolution":{"observed_at":"2026-08-07T01:02:28.608823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.527798Z","title":"Perspective api, 2024","venue":null,"work_id":"b48a416d-7bd1-4aa9-9710-077146f761d6","year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.647062Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:6ff8c3b74f69bdf9392c38755d512bc1a1c821f4b85b2c487424ee9f75a80c27","observation_id":"4a6827c6-57e4-4c4f-b82b-4a02dbd4b8be","resolution":{"observed_at":"2026-08-07T01:02:32.614286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:28.827911Z","title":"Guard: Role-playing to generate natural-language jailbreakings to test guideline adherence of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.827911Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c032b30e65c08b60a4bdff2c52e8cf34eec6d8eced545cf48f7b878edd5e1696","observation_id":"9feef088-88b1-411c-a5e0-edf3e581e8f5","resolution":{"observed_at":"2026-08-07T01:02:28.827911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20413","last_updated":"2024-05-30T18:38:36Z","snapshot_observed_at":"2026-07-06T18:22:57.400982Z","submitted_at":"2024-05-30T18:38:36Z","title":"Jailbreaking Large Language Models Against Moderation Guardrails via Cipher Characters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20413","snapshot_observed_at":"2026-08-07T01:02:28.929877Z","title":"Menke, and Haohan Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.929877Z"},"links":{"cited_paper":"/paper/2405.20413","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:32301665d748f5f08c892d589bb21491e2fd38b3f98a6bcf393b9463e3e65e6c","observation_id":"0aaacc26-e9ae-46e3-b432-fb1b3be88750","resolution":{"observed_at":"2026-08-07T01:02:28.929877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04381","last_updated":"2023-03-08T05:09:59Z","snapshot_observed_at":"2026-07-06T15:00:01.455874Z","submitted_at":"2023-03-08T05:09:59Z","title":"Automatically Auditing Large Language Models via Discrete Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04381","snapshot_observed_at":"2026-08-07T01:02:29.019773Z","title":"Automatically auditing large language models via discrete optimization, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.019773Z"},"links":{"cited_paper":"/paper/2303.04381","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:7582000f39dbd3eedaf7adfa5f3d1bfcb9728aa16e28cef89509c951ea0fb71c","observation_id":"f29a9c8c-1f44-4a57-a31a-e16b4f2438e7","resolution":{"observed_at":"2026-08-07T01:02:29.019773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-08-11T03:09:40.549869Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-07T01:02:29.162442Z","title":"Drattack: Prompt decomposition and reconstruction makes powerful llm jailbreakers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.162442Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:62774294feae630e60985f5de0d09eec2829f05f1e08b239e77aab23bbfef42a","observation_id":"65c9f057-029c-4115-b33d-15030852ea12","resolution":{"observed_at":"2026-08-07T01:02:29.162442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T01:02:29.259137Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.259137Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:051f05c9711b74029fda2c1322c26b0ab98df8d1fe6bf9aedc694400c9279073","observation_id":"4a430d69-8ffb-4eb8-99a2-165fd2e62582","resolution":{"observed_at":"2026-08-07T01:02:29.259137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.328732Z","title":"Latent space cartography: Visual analysis of vector space embeddings","venue":null,"work_id":"debdd3be-e550-4a79-9af1-6064a2b1d197","year":2019},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.359293Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:b3ca5633b7e1070e6bdfc3af110ccb77b60af30d0fb0506fe5370734de52c07a","observation_id":"541aa07d-fcb4-422d-9be6-2c74fe02c0ea","resolution":{"observed_at":"2026-08-07T01:02:32.406428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04237","last_updated":"2023-05-29T17:06:45Z","snapshot_observed_at":"2026-08-09T19:28:46.592382Z","submitted_at":"2023-02-08T18:07:31Z","title":"Black Box Adversarial Prompting for Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04237","snapshot_observed_at":"2026-08-07T01:02:29.510173Z","title":"Black box adversarial prompting for foundation models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.510173Z"},"links":{"cited_paper":"/paper/2302.04237","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:2a8fa0008b927459d275586179853291655555b3cf1aa88931a91e40c0462682","observation_id":"6efa3274-449a-4025-b20e-ff89ea5efc74","resolution":{"observed_at":"2026-08-07T01:02:29.510173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-07T01:02:29.635233Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.635233Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:17145002733a4a4a60d6b2ba129fb2782b16060f3fbeb70f9c57d5e86732f274","observation_id":"a809df2a-ab18-47f9-853a-35b55696cd33","resolution":{"observed_at":"2026-08-07T01:02:29.635233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-07T01:02:29.718383Z","title":"Tree of attacks: Jailbreaking black-box llms automatically, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.718383Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0bf16a9cb229b4e5f76703708bcc9ea432cc75e2244a8786aa95d16f223a9991","observation_id":"24cad203-093f-4e9c-bf12-42058fd26783","resolution":{"observed_at":"2026-08-07T01:02:29.718383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00436","last_updated":"2023-10-05T12:59:59Z","snapshot_observed_at":"2026-08-05T10:40:40.562724Z","submitted_at":"2023-08-01T10:31:36Z","title":"SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00436","snapshot_observed_at":"2026-08-07T01:02:29.757780Z","title":"Selfcheck: Using llms to zero-shot check their own step-by-step reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.757780Z"},"links":{"cited_paper":"/paper/2308.00436","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:4406f406cadbe58304d73564cdcd64134156a786fa9320f4f1b30b1bc881482b","observation_id":"10e19b5b-e007-47c4-bf0a-f615dafda644","resolution":{"observed_at":"2026-08-07T01:02:29.757780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.172119Z","title":"Openai moderation api, 2024","venue":null,"work_id":"3db39a0e-c830-488a-a06f-b29ba7d6daf9","year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.845731Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:e4a8d043f5d0b7a33e2f87859a6a3db21b96be07b42da72eb1d79c59aa4728c2","observation_id":"6200ca5a-b30b-4867-b0b9-f8011ce157a4","resolution":{"observed_at":"2026-08-07T01:02:32.219003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T01:02:29.913107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.913107Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c8ea7b9a5b103604ee07fda63b96c3a8c8e584f922abc9d44a8988e9dccb681a","observation_id":"b38239c3-6085-4789-8206-326b6f1e0291","resolution":{"observed_at":"2026-08-07T01:02:29.913107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.027097Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.027097Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:2b75e5271778167e24d0f748b5bd9481dbfe6c1fb7d422b72cc18c685e30cec0","observation_id":"6b8825c2-d16d-4378-bea6-e14046117ef8","resolution":{"observed_at":"2026-08-07T01:02:30.027097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-05T10:26:02.067012Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-07T01:02:30.091792Z","title":"Advprompter: Fast adaptive adversarial prompting for llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.091792Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:3cc6efc098a1b773888340022e36300f4da774ec9e35a7df7c641688eb846252","observation_id":"80fcbd30-de18-44ae-81ce-192f881e457b","resolution":{"observed_at":"2026-08-07T01:02:30.091792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.174966Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.174966Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0f6cdc1df143ddc7bd14e34e51c136cf590e883a37d5665f5c00011c4fa761a3","observation_id":"b793d7b8-c6d6-4b08-b920-345c2a849c87","resolution":{"observed_at":"2026-08-07T01:02:30.174966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07865","last_updated":"2024-09-14T11:41:49Z","snapshot_observed_at":"2026-08-10T03:17:35.544423Z","submitted_at":"2024-03-12T17:55:38Z","title":"CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07865","snapshot_observed_at":"2026-08-07T01:02:30.366652Z","title":"Exploring safety generalization challenges of large language models via code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.366652Z"},"links":{"cited_paper":"/paper/2403.07865","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:925965d2c25e9e587b6c68ed205edbd442b16277f88a9ebc60d8fef29e10a9cd","observation_id":"c0c2182a-f26f-4c40-bf7f-b3bcf6a1a0da","resolution":{"observed_at":"2026-08-07T01:02:30.366652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T01:02:30.422551Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.422551Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c1e8b2acf50ebc6bc5eef6a31034938a646233c5d67854964b83856c83762567","observation_id":"314bd4fa-9e4f-4c90-8d5a-5b5c89129320","resolution":{"observed_at":"2026-08-07T01:02:30.422551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.513966Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.513966Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:a5ad4d65d1cb4446112989aba6a4666035aede67f792dc8fbbab1d4b67ec8493","observation_id":"5ab4b317-26e8-41fe-b82d-e552fd642400","resolution":{"observed_at":"2026-08-07T01:02:30.513966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.587700Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.587700Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:e7f66880f9067e062d57d96ef8e07828da86b10eed3af9d559a7dd6647e273a5","observation_id":"7c95f0d9-0902-46fa-9095-085198e0c53e","resolution":{"observed_at":"2026-08-07T01:02:30.587700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.712250Z","title":"Large language models in medicine","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.712250Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:081a3341a6bcd5a176fda7df74c32b6c6593f7f11d12f6176fc5f1628264fc6f","observation_id":"dbd642cc-ed8a-4ba2-8d62-f8a6c359e9da","resolution":{"observed_at":"2026-08-07T01:02:30.712250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T01:02:30.756720Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.756720Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:2b266f179d7aa138e5227299f0411c3e3a706d1059b31a33efaad5ae34f39206","observation_id":"fcdfa2ab-2f5c-43c9-ab85-01f48fa5160e","resolution":{"observed_at":"2026-08-07T01:02:30.756720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.856232Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.856232Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:a871e791370398a4fe866888adacfb9980a9de975fb11ed29d9a373da3863dcb","observation_id":"8ab6afcf-d67c-4ad8-a10a-563b24ebe579","resolution":{"observed_at":"2026-08-07T01:02:30.856232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.934742Z","title":"Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.934742Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:9c0a034f23a86e766d6ab396a286d44f3d7f4e8e5f326538d8a7bfed2af6ad92","observation_id":"c709599e-1314-44af-9e8d-3c787a4fce59","resolution":{"observed_at":"2026-08-07T01:02:30.934742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-07T01:02:31.037588Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.037588Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:d21085fa6bc8e25c356b0003047cdfc801cc495f451f3b9498908651d64fbb4f","observation_id":"55f36b96-93fa-4d92-8919-e1cc47c74088","resolution":{"observed_at":"2026-08-07T01:02:31.037588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-07T01:02:31.124015Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.124015Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:5399f748029f1fe02767a30859356e3a56ae0c2ce8fc20fc2812e9ea94d48b9a","observation_id":"73cea915-73c7-46c1-b2e3-ef246887c76b","resolution":{"observed_at":"2026-08-07T01:02:31.124015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09827","last_updated":"2024-02-29T08:20:07Z","snapshot_observed_at":"2026-07-06T16:48:33.164024Z","submitted_at":"2023-11-16T11:52:22Z","title":"Cognitive Overload: Jailbreaking Large Language Models with Overloaded Logical Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09827","snapshot_observed_at":"2026-08-07T01:02:31.192664Z","title":"Cognitive overload: Jailbreaking large language models with overloaded logical thinking, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.192664Z"},"links":{"cited_paper":"/paper/2311.09827","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:234fdf5f366f701202f48fc62bf281520390cd8a86718b955107515e91eb2295","observation_id":"dce94c35-f6d7-4b5d-a23d-c2fc8e2b52e1","resolution":{"observed_at":"2026-08-07T01:02:31.192664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-07T01:02:31.303381Z","title":"Gpt-4 is too smart to be safe: Stealthy chat with llms via cipher","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.303381Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:7a726b8a97c58c140e3cb097fb6a1777c54da7041186fa18d4a372aefd1bc087","observation_id":"94e37423-7f20-4f0d-a15e-2c7c1724b829","resolution":{"observed_at":"2026-08-07T01:02:31.303381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-08-10T11:13:59.778209Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-07T01:02:31.370445Z","title":"How johnny can persuade llms to jailbreak them: Rethinking persuasion to challenge ai safety by humanizing llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.370445Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:bd5c214d2c5af003624aca32040f0baa8c8fce186e5a98bc3fe981b6c780d2a9","observation_id":"9b10db3e-a698-4987-a2eb-a75b8bdc3bc4","resolution":{"observed_at":"2026-08-07T01:02:31.370445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T01:02:31.476445Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.476445Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:50c30427f5f42c1ddc35b73b80dc17b3b716333f8ee4e8157d0f3a1532bc8f74","observation_id":"73804334-59f5-4743-8987-c8ad397573d2","resolution":{"observed_at":"2026-08-07T01:02:31.476445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T00:29:06.890225Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.12274."}