{"as_of":"2026-08-09T21:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e9c7873cdbc542a537c80b30c61c149db5190363971c9b49f0d8f2501e0e002","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T16:18:40.974536Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T14:41:41.501726Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-09T16:18:40.974536Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training.arXiv preprint arXiv:2407.09121, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01208","last_updated":"2025-06-20T10:54:05Z","snapshot_observed_at":"2026-08-09T16:35:47.837184Z","submitted_at":"2025-02-03T09:59:32Z","title":"On Almost Surely Safe Alignment of Large Language Models at Inference-Time","version":3},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-09T16:18:40.974536Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2502.01208"},"observation_digest":"sha256:9c662c71390fb977d2ca25a55e788c7b812abebf0d2e091751cc17f87ed24596","observation_id":"84397eef-1dc0-4725-8c09-8c0ba4f837e6","resolution":{"observed_at":"2026-08-09T16:18:40.974536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-08T23:50:36.272301Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04040","last_updated":"2025-05-30T09:43:42Z","snapshot_observed_at":"2026-08-08T23:43:13.905441Z","submitted_at":"2025-02-06T13:01:44Z","title":"Safety Reasoning with Guidelines","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-08T23:50:36.272301Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2502.04040"},"observation_digest":"sha256:d77978b4b4b56d5223b8219d11fd1f547aea5c7e42f7f888a0235857e94e9735","observation_id":"ea402bf6-fec3-45fc-9897-95df0e627f81","resolution":{"observed_at":"2026-08-08T23:50:36.272301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-09T14:47:15.397309Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-08-09T14:40:37.335660Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-09T14:47:15.397309Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2502.05209"},"observation_digest":"sha256:6d91927fddb31d5750127b50a136388e31996f2035b2a197934189bd746d8c9e","observation_id":"aefc68dd-f5a7-4218-8fe3-77f7c6f34395","resolution":{"observed_at":"2026-08-09T14:47:15.397309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-08T17:02:47.514685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09638","last_updated":"2025-05-29T06:12:00Z","snapshot_observed_at":"2026-08-09T01:40:08.338849Z","submitted_at":"2025-02-09T20:49:16Z","title":"Jailbreaking to Jailbreak","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T17:02:47.514685Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2502.09638"},"observation_digest":"sha256:b61496778e761f5fd00656c28e19100beae40359d39e9369e9a08997f4bbe137","observation_id":"ca9cbe33-01aa-45cb-b919-82b450a60b18","resolution":{"observed_at":"2026-08-08T17:02:47.514685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-08T11:26:27.914775Z","title":"arXiv:2407.09121 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10450","last_updated":"2025-06-11T17:44:34Z","snapshot_observed_at":"2026-08-09T04:10:19.287139Z","submitted_at":"2025-02-11T20:08:42Z","title":"Trustworthy AI: Safety, Bias, and Privacy -- A Survey","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:26:27.914775Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2502.10450"},"observation_digest":"sha256:a99c924b8adfd32a95c8843442a22b4b0edaa04dc6727ed4a2241b9fd6b2b785","observation_id":"642ec696-35a0-4a90-9224-1ed5881a722e","resolution":{"observed_at":"2026-08-08T11:26:27.914775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":"2407.09121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training.arXiv preprint arXiv:2407.09121","venue":null,"work_id":"d2df5cde-3643-4904-80ac-5e999f629df6","year":2024},"citing_paper":{"arxiv_id":"2505.14226","last_updated":"2026-04-07T12:14:38Z","snapshot_observed_at":"2026-08-08T04:00:07.253604Z","submitted_at":"2025-05-20T11:35:25Z","title":"Phonetic Perturbations Reveal Tokenizer-Rooted Safety Gaps in LLMs","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T14:40:58.506345Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2505.14226"},"observation_digest":"sha256:8a5988d4d772953fdfac78ff6f6e34bc52004f460e7592a2aa56ae826742734b","observation_id":"22d5e7c4-e50c-456b-982f-8600d93c2a86","resolution":{"observed_at":"2026-05-22T14:41:41.504894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-07T14:00:09.569239Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20259","last_updated":"2025-05-26T17:40:40Z","snapshot_observed_at":"2026-08-07T13:53:48.214686Z","submitted_at":"2025-05-26T17:40:40Z","title":"Lifelong Safety Alignment for Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:09.569239Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2505.20259"},"observation_digest":"sha256:6e5315c3cc7ece00b88315999b52794c8db00f26b33fba95cf9c79c2d74bc996","observation_id":"e5ba28bf-bc90-443c-b2b9-76d055c25e1f","resolution":{"observed_at":"2026-08-07T14:00:09.569239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-07T11:51:33.126948Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01307","last_updated":"2025-06-02T04:33:56Z","snapshot_observed_at":"2026-08-07T11:42:31.717394Z","submitted_at":"2025-06-02T04:33:56Z","title":"Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:33.126948Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2506.01307"},"observation_digest":"sha256:a1ad3eefa0f8646ecafdaf1db3c92f676a9392e093bd85056cd6e4099a0f66aa","observation_id":"24f406f7-dac3-4aae-af34-04176296cb90","resolution":{"observed_at":"2026-08-07T11:51:33.126948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-07T12:11:25.746161Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05376","last_updated":"2025-06-09T05:48:22Z","snapshot_observed_at":"2026-08-07T12:39:09.825243Z","submitted_at":"2025-05-30T22:58:54Z","title":"A Red Teaming Roadmap Towards System-Level Safety","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.746161Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2506.05376"},"observation_digest":"sha256:cc082925c55b826907880a8e27ccab9c90c6a88907ca75d2f71d4cb83c7682f2","observation_id":"c8c4074d-5f65-4a4b-b144-c47671818d02","resolution":{"observed_at":"2026-08-07T12:11:25.746161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-08-07T00:15:05.291677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14922","last_updated":"2025-06-24T19:55:23Z","snapshot_observed_at":"2026-08-07T04:49:42.432527Z","submitted_at":"2025-06-17T19:08:02Z","title":"FORTRESS: Frontier Risk Evaluation for National Security and Public Safety","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:05.291677Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2506.14922"},"observation_digest":"sha256:84e5b0ec58023fd44ffad20d12fa2905ee048402bdc79a63e5bd487300ae6f09","observation_id":"168523f8-e758-40be-8b91-fce8b89932d7","resolution":{"observed_at":"2026-08-07T00:15:05.291677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training","version":2},"cited_work":{"arxiv_id":"2407.09121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.09121","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Refuse whenever you feel unsafe: Improving safety in llms via decoupled refusal training.arXiv preprint arXiv:2407.09121","venue":null,"work_id":"d2df5cde-3643-4904-80ac-5e999f629df6","year":2024},"citing_paper":{"arxiv_id":"2604.04992","last_updated":"2026-04-05T13:37:52Z","snapshot_observed_at":"2026-07-06T22:53:51.418227Z","submitted_at":"2026-04-05T13:37:52Z","title":"FreakOut-LLM: The Effect of Emotional Stimuli on Safety Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T16:51:46.603418Z"},"links":{"cited_paper":"/paper/2407.09121","citing_paper":"/paper/2604.04992"},"observation_digest":"sha256:9f880d0aae21e7dd83e39c21c3c06cf9c535e57859407a4c269c4caac30a5621","observation_id":"82d4339c-c82e-4811-b377-3721eb6781f0","resolution":{"observed_at":"2026-05-13T16:52:59.995770Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.09121/citation-record","integrity":"/paper/2407.09121/integrity","json":"/paper/2407.09121/citation-record.json","paper":"/paper/2407.09121"},"outbound":[],"paper":{"arxiv_id":"2407.09121","last_updated":"2025-05-23T04:31:00Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T06:20:02.075920Z","submitted_at":"2024-07-12T09:36:33Z","title":"Refuse Whenever You Feel Unsafe: Improving Safety in LLMs via Decoupled Refusal Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2407.09121."}