{"as_of":"2026-08-23T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d4085bed8bfcd64ac7b2bda82b3e370e07d9888197e082918f83e9e493c97027","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:54:12.847460Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:54:06.538826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:26:59.311234Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.04365","snapshot_observed_at":"2026-08-05T12:54:06.538826Z","title":"Attention slipping: A mechanistic understanding of jailbreak attacks and defenses in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06982","last_updated":"2025-09-01T04:50:02Z","snapshot_observed_at":"2026-08-18T23:23:48.168712Z","submitted_at":"2025-09-01T04:50:02Z","title":"CARE: Decoding Time Safety Alignment via Rollback and Introspection Intervention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T12:54:06.538826Z"},"links":{"cited_paper":"/paper/2507.04365","citing_paper":"/paper/2509.06982"},"observation_digest":"sha256:0d3fff177a87699067f3583b1ec31ac7257be7cefcfdcb7dfafeb24414fd9dee","observation_id":"5f1b3b36-483b-4781-ada2-c313b1e68a85","resolution":{"observed_at":"2026-08-05T12:54:06.538826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"cited_work":{"arxiv_id":"2507.04365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.04365","snapshot_observed_at":"2026-07-02T13:26:59.311234Z","title":"arXiv preprint arXiv:2507.04365 , year=","venue":null,"work_id":"bb50d9f8-e3b6-4c33-9a52-0436a7708350","year":null},"citing_paper":{"arxiv_id":"2606.05609","last_updated":"2026-06-04T02:31:29Z","snapshot_observed_at":"2026-08-05T14:48:48.513078Z","submitted_at":"2026-06-04T02:31:29Z","title":"SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T01:16:07.252429Z"},"links":{"cited_paper":"/paper/2507.04365","citing_paper":"/paper/2606.05609"},"observation_digest":"sha256:55e8c05ea907253587fdd87d58795ffd53bff551951736b84b31464fd7321a54","observation_id":"3c705765-eeba-40e8-95fc-02ca55f8dee6","resolution":{"observed_at":"2026-07-02T13:26:59.312672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.04365/citation-record","integrity":"/paper/2507.04365/integrity","json":"/paper/2507.04365/citation-record.json","paper":"/paper/2507.04365"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:16.674127Z","title":"Bowman, Ethan Perez, Roger B","venue":null,"work_id":"a568288a-5ae0-43ba-949d-3c00cf7b2637","year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.120032Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:1af245b044d514a99b1f9b0f115622b999ff73eff8479c67b114dd0be003c860","observation_id":"ed19b6ad-0d61-44f6-82e2-19592791cf44","resolution":{"observed_at":"2026-08-06T19:54:16.871531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T19:54:09.296540Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.296540Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:2373bacfd323237c9d6d83872aaa0cf2e301aeeb81dc13f66e8367afcc73912c","observation_id":"5b845d7d-de3a-4664-96bf-60899d8be88b","resolution":{"observed_at":"2026-08-06T19:54:09.296540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:16.398468Z","title":"Zico Kolter","venue":null,"work_id":"bff8ac3b-fdaa-4e06-9caa-f64576524974","year":2019},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.403630Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:f125bd4bc24dc45ee9b14a4abf122a7f118f39d7a2ac01cd0976fe2aa9646d97","observation_id":"f66d6f79-7d2c-4b13-b5e1-5eb1f2785950","resolution":{"observed_at":"2026-08-06T19:54:16.525171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T19:54:09.473833Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.473833Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:72ed9b407aed7ce3cf3ea283e9ac0810739ebdb476dab0991b8f3f7e2a83ed67","observation_id":"d07ac786-cf88-49bb-96db-b3fbc6d406e1","resolution":{"observed_at":"2026-08-06T19:54:09.473833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:16.147424Z","title":null,"venue":null,"work_id":"bfcaa109-ad3b-4c71-8d81-76670e65e84d","year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.551089Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:f2e29972fcc2be095d43612a0c57b3c15ec4476785460a2c0b3bfc31dd8a6878","observation_id":"d46fb15d-4d9e-4bac-8e2d-91c6fcac36ae","resolution":{"observed_at":"2026-08-06T19:54:16.254930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:15.921120Z","title":"Token highlighter: Inspecting and mitigating jailbreak prompts for large language models","venue":null,"work_id":"4e9ea937-605f-4e93-9ff5-b9e6c327d469","year":2025},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.611247Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:5b04907812a166c8f0acf664aba223829c4937bbea94871dfa60e46ae94318b4","observation_id":"48d1a98c-12c5-459b-af6c-feb27d1f27f5","resolution":{"observed_at":"2026-08-06T19:54:16.027866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-06T19:54:09.684400Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.684400Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:e9b26ab909772a9831624d9374794c339f749386e1ebd7c73d3dae5eb7a5886b","observation_id":"bf8fcf33-b58b-4596-9a6d-f3fd30712868","resolution":{"observed_at":"2026-08-06T19:54:09.684400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:09.839439Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.839439Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:3432b18b728231e0a3a7cb72afb2ef7f57fe698ccf8eb79ee035945b43e26e2f","observation_id":"87b3f59d-53ea-4897-9fb7-2616726aaa25","resolution":{"observed_at":"2026-08-06T19:54:09.839439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-16T14:36:14.029419Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-06T19:54:09.982978Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:09.982978Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:7e7e6804372fcf66c7c0023472f89b110dff252d9abb365e8e8f74c0eca0b77c","observation_id":"65e8a31d-8f11-4111-b10a-3e6f44fddd25","resolution":{"observed_at":"2026-08-06T19:54:09.982978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05206","last_updated":"2026-04-14T16:10:41Z","snapshot_observed_at":"2026-08-20T09:36:18.005089Z","submitted_at":"2025-02-02T05:14:22Z","title":"Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05206","snapshot_observed_at":"2026-08-06T19:54:10.094408Z","title":"Erfani, Bo Li, Masashi Sugiyama, Dacheng Tao, James Bailey, and Yu-Gang Jiang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.094408Z"},"links":{"cited_paper":"/paper/2502.05206","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:5b92e0b4f3c20bd29e57a8909a1f90e190b7c9c0e147268c6578c7c388711376","observation_id":"c10190c4-b752-494d-a3d4-1bc75b923637","resolution":{"observed_at":"2026-08-06T19:54:10.094408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-18T18:32:32.343266Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-06T19:54:10.231324Z","title":"Tree of attacks: Jailbreaking black-box llms automatically","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.231324Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:ea89ba09fbba54bf441fb002ea125c6a4f7a4f9cbc579f278d3283318ec2b57a","observation_id":"46b3415f-05b0-4731-a310-adfb9bc3f1ba","resolution":{"observed_at":"2026-08-06T19:54:10.231324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T19:54:10.352809Z","title":"GPT-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.352809Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:6e4c27dddfcccb813d6a476add3474b1853c5789000e97810cc97337fb5247f9","observation_id":"aa504a37-0b53-40b5-90e8-832619a453e6","resolution":{"observed_at":"2026-08-06T19:54:10.352809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-08-17T15:25:03.596568Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-06T19:54:10.497216Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.497216Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:b2fe5577438c413e520c0295fc69be11e57f968deb78227d01c408d41db84a35","observation_id":"15698224-46b7-4e96-9c96-bffdb51d7ee5","resolution":{"observed_at":"2026-08-06T19:54:10.497216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:15.654888Z","title":null,"venue":null,"work_id":"da475e1e-b8b5-409e-a0a8-7fe1cc7441be","year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.684287Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:f878ba2fd196ec9f1d122eb19fb770e3468b4bef087ce5db2b1d1d83a4d9b066","observation_id":"803559cc-ce6a-414a-801e-0e4e2297a345","resolution":{"observed_at":"2026-08-06T19:54:15.761278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T19:54:10.804884Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.804884Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:b901a16aae21179f861aafaed3af269069b4587579d3877f8691e9541d7b5581","observation_id":"a7a98138-4888-49b4-919a-bd33944a6e4b","resolution":{"observed_at":"2026-08-06T19:54:10.804884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:15.352209Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"994ae868-e69e-4529-8e57-f3cd6a991369","year":2017},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:10.923995Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:179c4fe14344867ee856387f275fdd527949617c02c9a83742899d3b9d6fc73a","observation_id":"34c8d635-0166-48a9-8601-43fe20c4b908","resolution":{"observed_at":"2026-08-06T19:54:15.522650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:15.105517Z","title":"Yu, Qingsong Wen, and Yang Liu","venue":null,"work_id":"0bfab7f1-f946-4b04-9061-99b37b15a8d0","year":2025},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.081110Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:8500ad38eb47561576372ab8200711c371aef63ef1e3ae375e13b2b42dbb74b4","observation_id":"ed5bec15-6373-4d12-a047-fdc5659bfdd5","resolution":{"observed_at":"2026-08-06T19:54:15.229719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-15T10:16:52.688429Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-06T19:54:11.189415Z","title":"Jailbroken: How does LLM safety training fail? CoRR, abs/2307.02483, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.189415Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:58d326f8d9dbe0407016c493e165d5576d9c7477aafa02e300df5b7759a4c899","observation_id":"5b8c7c9a-59fd-4c5b-854f-6071827ddde2","resolution":{"observed_at":"2026-08-06T19:54:11.189415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:14.858271Z","title":"Defending chatgpt against jailbreak attack via self-reminders","venue":null,"work_id":"dd487db4-0c2c-4457-b405-854b5ad940dc","year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.364637Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:4435e458f56c377ada30484017e85d763603d6bab9009e6beecd8f8ddde212a7","observation_id":"281b06a9-2921-4fd4-9b5a-43addc867693","resolution":{"observed_at":"2026-08-06T19:54:14.987500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:14.574125Z","title":"Safedecoding: Defending against jailbreak attacks via safety-aware decoding","venue":null,"work_id":"83e7fe23-a155-4fbe-9399-ce478f76a52f","year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.530520Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:ea453b5fe90b0cc9311d9cccc865f452905842d758c75dfdf91516ccacb66d70","observation_id":"44031e8f-993a-4c66-8791-99f1696146f0","resolution":{"observed_at":"2026-08-06T19:54:14.695109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-06T19:54:11.686321Z","title":"Jailbreak attacks and defenses against large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.686321Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:bd135d2fd15b90e3bee674f245e6250a31f54801a89049405005798f77be51b8","observation_id":"3d4ba01d-58e9-4a56-8fad-03f5838ddbae","resolution":{"observed_at":"2026-08-06T19:54:11.686321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T19:54:11.798190Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.798190Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:8de69148f2324744a93a057dbb14068df06ee7d918649b6b32944fef2f2d9165","observation_id":"e392ee3c-fb5c-481c-9615-e62c0bd6c656","resolution":{"observed_at":"2026-08-06T19:54:11.798190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T19:54:11.959670Z","title":"Attention Sharpening","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.959670Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:ca52228f56b1e1b72bc344722039e77eae4d23b91cb5362beae574257ace42af","observation_id":"ba7b66aa-1fbd-4999-9ebd-7bdd9a34e7b0","resolution":{"observed_at":"2026-08-06T19:54:11.959670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:14.309535Z","title":"Each matrix has dimensions d × d, and there are four such matrices: Memory for attention matrices = 4d2","venue":null,"work_id":"cebcf365-644d-4f60-84fd-e735f6fc7e54","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.083145Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:97671e57b36dba0c5aeb8e5c73e64337012aacef99c6de660f99df33dcdaa020","observation_id":"046c14d0-ecf8-4438-a0aa-a7d59829a5b7","resolution":{"observed_at":"2026-08-06T19:54:14.418062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:14.035723Z","title":"The first maps the input dimension d to an intermediate dimension 4d, and the second maps back to d","venue":null,"work_id":"8139e293-8f59-4d94-aa11-8f4fca6ec2a8","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.219701Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:31ed0cb654ffac0fc64fe8b7a62d15925942c39b664dd477175bfe5882dd8e63","observation_id":"86198f14-e088-479d-9735-6c0ccc9a442a","resolution":{"observed_at":"2026-08-06T19:54:14.162079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:13.792409Z","title":"With n + m tokens in total (e.g., n input tokens and m output tokens), the memory required for Keys and Values per layer is: Key/Value Memory per layer (bytes) = 4(n + m)d","venue":null,"work_id":"bb6d88a0-7a18-4d7f-8292-0b88992e57d2","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.366585Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:daf5914eb5582d216e24b73aee220cf80e84c346687e276aa849d1681646d729","observation_id":"8f7bb32d-8ba1-40fc-a6e7-876053682a09","resolution":{"observed_at":"2026-08-06T19:54:13.924016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:13.575650Z","title":null,"venue":null,"work_id":"0cabbd6c-ee58-47d1-9b57-282d0e55edd1","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.524515Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:8cc256de898091de0561596555c8b98ca10189f181579281bc7f148f13e30b6f","observation_id":"234e7a8c-c05b-45d5-8c90-ef33670f17bb","resolution":{"observed_at":"2026-08-06T19:54:13.681569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:13.304357Z","title":null,"venue":null,"work_id":"f446c9a1-d91e-4b81-8b03-39c3d80c96af","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.695682Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:555d23c8385d13f414e188a607024c7c123c772d94f21546dd2e8cd3eff67f04","observation_id":"50d55ebd-4441-4f3a-8d0a-1931f66db025","resolution":{"observed_at":"2026-08-06T19:54:13.410898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:13.107065Z","title":null,"venue":null,"work_id":"a391c7f3-4e80-43ba-a9d3-97c172b1ffb9","year":null},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:12.847460Z"},"links":{"citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:624b9f6b88e62d40809a34f17b76780219fc439af734fe6b8e4cea2779e6ddf0","observation_id":"e9d4c793-97d0-4547-a529-97ef0be96397","resolution":{"observed_at":"2026-08-06T19:54:13.209306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2507.04365."}