{"as_of":"2026-08-09T04:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5aa978ff2bee6ca11be655340fcce4bf6aba9434810e581b26f9d2698f70e22d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T10:23:06.284811Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:36:08.540565Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":201,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:4f7c2870af4243a668aa89060f906fe4ef4b866ed316082b0fd6daa2ccd295a5","observation_id":"96816ab0-ea0e-4e03-b2d8-bd1b244f6442","resolution":{"observed_at":"2026-05-13T10:47:56.160539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-08T10:23:06.284811Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08142","last_updated":"2025-02-12T05:48:57Z","snapshot_observed_at":"2026-08-09T00:12:26.816440Z","submitted_at":"2025-02-12T05:48:57Z","title":"Bridging the Safety Gap: A Guardrail Pipeline for Trustworthy LLM Inferences","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T10:23:06.284811Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2502.08142"},"observation_digest":"sha256:222a5f5c28e9a2df414d08a6d8021ac9cdf74c769be685ece10bcdc491c0624a","observation_id":"ba93dbd7-895a-4e70-a74b-d4b06a2bf240","resolution":{"observed_at":"2026-08-08T10:23:06.284811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-07T05:47:06.503637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.503637Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:6e277d6ca924fe99c5573d0e615b19d28808de3a4707259f81fb1ce1d49e3c83","observation_id":"4ec1c18d-206d-45a6-ad1b-233c7e70c5d4","resolution":{"observed_at":"2026-08-07T05:47:06.503637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-06T14:45:42.912963Z","title":"A comprehensive study of jailbreak attack versus defense for large language models.arXiv preprint arXiv:2402.13457,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18105","last_updated":"2025-07-24T05:30:54Z","snapshot_observed_at":"2026-08-07T21:22:02.859315Z","submitted_at":"2025-07-24T05:30:54Z","title":"Understanding the Supply Chain and Risks of Large Language Model Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:42.912963Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2507.18105"},"observation_digest":"sha256:92bc4941deeb2efffeb521330e1e06f396a8a2d9e83f16150da1044d6d5eedc9","observation_id":"c3576dbb-ce6f-4b77-ad91-e23a35fc89f5","resolution":{"observed_at":"2026-08-06T14:45:42.912963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-05T22:24:23.361494Z","title":"A comprehensive study of jail- break attack versus defense for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07139","last_updated":"2025-08-10T01:59:07Z","snapshot_observed_at":"2026-08-06T02:11:07.077923Z","submitted_at":"2025-08-10T01:59:07Z","title":"A Real-Time, Self-Tuning Moderator Framework for Adversarial Prompt Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:24:23.361494Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.07139"},"observation_digest":"sha256:7c57a091bc91f9745eff806a63163deb95194d920abc424edeacf01da26a4984","observation_id":"25f5f323-7136-4f16-b93b-e827df8a1a61","resolution":{"observed_at":"2026-08-05T22:24:23.361494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-05T20:31:45.398903Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:45.398903Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:3375ce29c156957d05f735faf83a74237dc1a41d0088d8003b39c0e0a7cae09a","observation_id":"9c20c9f8-8f70-4da7-a200-a906231ac9c9","resolution":{"observed_at":"2026-08-05T20:31:45.398903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2508.11222","last_updated":"2025-12-05T05:36:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-15T05:03:26Z","title":"ORFuzz: Fuzzing the \"Other Side\" of LLM Safety -- Testing Over-Refusal","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T23:27:52.438709Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.11222"},"observation_digest":"sha256:fd13d535bcace5e87c4c122685f2af9c2cea2a18f49d0152651e225f33d894cc","observation_id":"5f48ed78-a3b3-4fbc-8a64-39d31cbf9d26","resolution":{"observed_at":"2026-05-18T23:31:54.591943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-04T23:09:41.435223Z","title":"Llm jailbreak at- tack versus defense techniques–a comprehensive study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.435223Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:fd60f268891c8f87d589c59a554417e51095b6a4e8902b3d03d893eaab5e2f7f","observation_id":"ead34801-dcd9-434d-b7cf-10580f06e3e0","resolution":{"observed_at":"2026-08-04T23:09:41.435223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-04T22:33:28.168620Z","title":"A comprehensive study of jailbreak attack versus defense for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-06T22:54:10.353309Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.168620Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ef579e708da7173649fa122e9d881765bd6a5b768b3a0c26a269b9eb3224e88c","observation_id":"aa9e6cc6-b697-400f-9c2e-fd2873f19520","resolution":{"observed_at":"2026-08-04T22:33:28.168620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2604.09747","last_updated":"2026-04-10T07:22:11Z","snapshot_observed_at":"2026-07-06T22:58:34.504325Z","submitted_at":"2026-04-10T07:22:11Z","title":"ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T17:57:59.918483Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2604.09747"},"observation_digest":"sha256:156482f81919dffffbc4fb7e8b3c2e98353f5881afa030799b17f80ddadf6f66","observation_id":"f8a6ee22-da7a-4884-9f88-a3c118714fda","resolution":{"observed_at":"2026-05-11T05:45:57.609447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:495b335fb504badecba680eaa5bf87b6652025c9cec4fead9c26b36c5a1a1225","observation_id":"ca2742c6-95f2-45f1-8ee9-319bba9a33bb","resolution":{"observed_at":"2026-05-11T09:16:04.374380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2606.00150","last_updated":"2026-05-29T03:31:16Z","snapshot_observed_at":"2026-08-03T01:34:57.941568Z","submitted_at":"2026-05-29T03:31:16Z","title":"Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T22:23:00.894059Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2606.00150"},"observation_digest":"sha256:cd82daf2b7505c4c4f34bf1e63898f09cc44ebc218c2fa57a698f442b9936fd5","observation_id":"e46e7c62-8614-458f-9e27-838cb4dc1f6d","resolution":{"observed_at":"2026-07-01T19:36:08.542160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13457/citation-record","integrity":"/paper/2402.13457/integrity","json":"/paper/2402.13457/citation-record.json","paper":"/paper/2402.13457"},"outbound":[],"paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2402.13457."}