{"as_of":"2026-08-09T12:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:889805893bc7b38b1eca5f0ed709925f4af8bf4ba4796089b701f7f8f3f70157","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:27:47.482807Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02442/citation-record","integrity":"/paper/2506.02442/integrity","json":"/paper/2506.02442/citation-record.json","paper":"/paper/2506.02442"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:27:47.122877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.122877Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:cc47e4ca93d84102bd27e92ecda0a5aaea1ba4f0c29af26c19c8559fcc608a25","observation_id":"4f626177-35eb-4ab9-bd5b-a0c7274a307b","resolution":{"observed_at":"2026-08-07T11:27:47.122877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.173620Z","title":null,"venue":null,"work_id":"d297f7be-e1e4-4209-a9c2-cf9de5ea4733","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.129536Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:365595d7061faea27177ab9f5f32c64e85ba31114179db1a6683f894f5ce2d7f","observation_id":"52404c4d-5d6a-471e-a625-cda4dadbb19f","resolution":{"observed_at":"2026-08-07T11:27:50.178348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-07-06T16:10:54.723336Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-07T11:27:47.137122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.137122Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:f4b7ed1eb09778c5e1392ee8801775d936bfb55cabeea88b75e6d7141e56e191","observation_id":"ae55402e-b8c8-4b91-8a4b-b978302c4afb","resolution":{"observed_at":"2026-08-07T11:27:47.137122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:27:47.144854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.144854Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:b208ded027331e8d4ae1cd4030b72a98b8c1f974b2b753aaf76a5eb4da3c3447","observation_id":"04624ff3-35b9-404b-ab65-c8b96582c804","resolution":{"observed_at":"2026-08-07T11:27:47.144854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.985889Z","title":null,"venue":null,"work_id":"ebc43177-265d-4090-95cd-63141a6667d6","year":2021},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.152801Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:82bc939c93224ff86f2f89b9cdbbf3b85512f1468ea79c55e27a687428358a1a","observation_id":"cc9f277e-c466-46c5-ac76-a412e39331ef","resolution":{"observed_at":"2026-08-07T11:27:50.095009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11445","last_updated":"2024-11-05T08:46:01Z","snapshot_observed_at":"2026-07-06T19:17:02.745056Z","submitted_at":"2024-09-17T03:39:45Z","title":"Jailbreaking Large Language Models with Symbolic Mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11445","snapshot_observed_at":"2026-08-07T11:27:47.159009Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.159009Z"},"links":{"cited_paper":"/paper/2409.11445","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:158234b256326e6e17b4182075f48d4b01d7fbf0d861692fb5fb0dddc89f91eb","observation_id":"a2c1901f-66e2-4c83-a48e-6db1d4fb6c5c","resolution":{"observed_at":"2026-08-07T11:27:47.159009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.166556Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.166556Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:0f412f08ba5b60801990c97c5d6dc130d42a5914782afc561531bc2558588d84","observation_id":"f11eae64-55f7-45ac-b29d-bf93198671f2","resolution":{"observed_at":"2026-08-07T11:27:47.166556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.865862Z","title":"Pappas, Florian Tram\\` e r, Hamed Hassani, and Eric Wong","venue":null,"work_id":"cb0e6cc7-a751-4a77-9cde-ad785a64f8a6","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.175424Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:dea52ee89d6582a7cf15c4618824e2ec83de47ca48d1a5041dba38cc9b28779e","observation_id":"bbb14b9f-4929-4411-a53d-120cf8f8b928","resolution":{"observed_at":"2026-08-07T11:27:49.928300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.709436Z","title":"Pappas, Florian Tram \\`e r, Hamed Hassani, and Eric Wong","venue":null,"work_id":"104ea033-26e6-4039-9c41-b8fcf2d56c1a","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.182198Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d6e40c254853b52c3714239b8297520295e1aacb4413cad7527415a97fc96296","observation_id":"c43bbd36-f338-4770-bffb-980105f6b432","resolution":{"observed_at":"2026-08-07T11:27:49.777409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03274","last_updated":"2024-12-02T08:53:40Z","snapshot_observed_at":"2026-08-02T08:56:14.285582Z","submitted_at":"2024-09-05T06:31:37Z","title":"Recent Advances in Attack and Defense Approaches of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03274","snapshot_observed_at":"2026-08-07T11:27:47.188977Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.188977Z"},"links":{"cited_paper":"/paper/2409.03274","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:df2369d6415d78646f8fded043a0b01de8f5148858af038f00b1184c6dc040f0","observation_id":"3ecfed4b-90af-4563-bbef-b163fb4546b3","resolution":{"observed_at":"2026-08-07T11:27:47.188977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09283","last_updated":"2024-03-27T13:55:14Z","snapshot_observed_at":"2026-07-06T17:30:08.206972Z","submitted_at":"2024-02-14T16:14:03Z","title":"Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09283","snapshot_observed_at":"2026-08-07T11:27:47.195714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.195714Z"},"links":{"cited_paper":"/paper/2402.09283","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d6eef0dde456282b06e336fb790e75a46e9ec3954202237e5cd7caba2419151a","observation_id":"5ca62124-816a-4f1f-9737-e4b7ec72e693","resolution":{"observed_at":"2026-08-07T11:27:47.195714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-67485-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":null,"venue":"History of computing","work_id":"cac04733-5046-4581-8398-e6beb376aa6b","year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.204744Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:cc3198af63af212ca641513feca446082b54c65ef8e76aab89b9820fc0e18900","observation_id":"c6b7078e-91a8-422d-af32-06c9c369cce8","resolution":{"observed_at":"2026-08-07T11:27:47.649065Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.583323Z","title":null,"venue":null,"work_id":"251521a5-97a0-47d9-b178-61106d00f76d","year":2019},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.213100Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:b1558be575653aecb63297159faa6d5126332b13e4dcc2e88f70607c40b0aa9c","observation_id":"72ae24e7-ab71-481b-9ca2-3158ebd550e2","resolution":{"observed_at":"2026-08-07T11:27:49.647650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04883","last_updated":"2018-01-15T17:32:04Z","snapshot_observed_at":"2026-08-01T20:21:10.276565Z","submitted_at":"2018-01-15T17:32:04Z","title":"Unsupervised Cipher Cracking Using Discrete GANs","version":1},"cited_work":{"arxiv_id":"1801.04883","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.04883","snapshot_observed_at":"2026-08-07T11:27:48.610565Z","title":"Unsupervised Cipher Cracking Using Discrete GANs","venue":"cs.LG","work_id":"ea3ac51e-d58e-4503-9acf-60bc26b8dc3b","year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.227011Z"},"links":{"cited_paper":"/paper/1801.04883","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:8b2445c6967653ce35f1056f53c22c39d59e23a56a73b33ca5e46f374d5c99ad","observation_id":"88b1e8b6-d140-46b4-a892-d0a8b718f7a3","resolution":{"observed_at":"2026-08-07T11:27:48.698390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T11:27:47.235852Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.235852Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5e93a049892bc906d32ee6cc0f389823581259000839bb93e86b6614af6d9c08","observation_id":"30ab4d27-9b68-4ebd-98b4-569097c9ddc8","resolution":{"observed_at":"2026-08-07T11:27:47.235852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.476853Z","title":null,"venue":null,"work_id":"d5c32c68-b38d-424f-afbf-9be00e4500bd","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.242254Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5d4fb7894a85ed52093e4f178b638b43276ed0fc28a181a0782ed4fd1a096948","observation_id":"567d72f0-94fd-42bf-9c2d-ba662c14ee19","resolution":{"observed_at":"2026-08-07T11:27:49.501436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.250751Z","title":"competency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.250751Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:45b05a9cc58a292928c00a95e823f41e39667c189010e008897d127a04987358","observation_id":"b07cb090-4083-40a9-ae2b-5094165514ae","resolution":{"observed_at":"2026-08-07T11:27:47.250751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.259907Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.259907Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:52db62f0f8faf890786394abd4585d7b2e5580e4364456f7a67c8db795143aab","observation_id":"f21550f7-2f32-4419-af9e-5c182045b666","resolution":{"observed_at":"2026-08-07T11:27:47.259907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01294","last_updated":"2025-05-10T19:38:13Z","snapshot_observed_at":"2026-08-08T20:47:41.527838Z","submitted_at":"2024-10-02T07:40:56Z","title":"Endless Jailbreaks with Bijection Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01294","snapshot_observed_at":"2026-08-07T11:27:47.272740Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.272740Z"},"links":{"cited_paper":"/paper/2410.01294","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:51baebf52ed2733032de3fa1c49267bc86b5082708855ea709414fd68fd361d0","observation_id":"5444761c-5f45-403b-93b7-032d835e6c19","resolution":{"observed_at":"2026-08-07T11:27:47.272740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T11:27:47.280600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.280600Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:022a8f486d657a0567fc755c4d6f0c899bfc000bb0cb988ef252a52e6200f82f","observation_id":"88b28cec-7931-4bd0-ab13-fd3bf806ad74","resolution":{"observed_at":"2026-08-07T11:27:47.280600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-07T11:27:47.286452Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.286452Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:7966d4d7d9461304f381e96af0906f902a3d12c231949d15a1d8da6dfb4cd3cf","observation_id":"d449b9ff-6312-494c-9fce-64e26117404f","resolution":{"observed_at":"2026-08-07T11:27:47.286452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:27:47.295083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.295083Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:7168e01345e86a00cdc5f23fcc6a94d27e2cfd87788e0052d02b2dc3369ccd1f","observation_id":"73344d01-9c0e-4c79-b7c9-733d12031035","resolution":{"observed_at":"2026-08-07T11:27:47.295083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11753","last_updated":"2024-06-07T17:35:17Z","snapshot_observed_at":"2026-07-06T17:31:58.268105Z","submitted_at":"2024-02-19T00:43:31Z","title":"ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11753","snapshot_observed_at":"2026-08-07T11:27:47.302318Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.302318Z"},"links":{"cited_paper":"/paper/2402.11753","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:95d992061697bac128fe998b75478829bd38e6002d50f10b4d013137215ab270","observation_id":"7093f919-ff68-48f4-8443-7131b57c8455","resolution":{"observed_at":"2026-08-07T11:27:47.302318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.310189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.310189Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:86066c5039e74bf1e020603326e39e126ae501d58158ed1788a168e18955755e","observation_id":"d5aaf8e2-e118-45dc-a18d-0d865ef72af0","resolution":{"observed_at":"2026-08-07T11:27:47.310189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19093","last_updated":"2025-04-27T03:41:17Z","snapshot_observed_at":"2026-08-07T15:58:53.969652Z","submitted_at":"2025-04-27T03:41:17Z","title":"CipherBank: Exploring the Boundary of LLM Reasoning Capabilities through Cryptography Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19093","snapshot_observed_at":"2026-08-07T11:27:47.317124Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.317124Z"},"links":{"cited_paper":"/paper/2504.19093","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:559ed692137d8e852b03aa198bb00ae165d9e38c789f91ba6f74733939043415","observation_id":"25be7c48-77af-4c52-8fb1-e932c0bf2cd7","resolution":{"observed_at":"2026-08-07T11:27:47.317124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T11:27:47.325604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.325604Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:fc970df95425cde9826f4aac3bb5223013f3faed49c73d0e846963ed61715bbc","observation_id":"d3919f68-8a83-4a68-bfdd-33df43cb7dea","resolution":{"observed_at":"2026-08-07T11:27:47.325604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-07-06T17:35:36.900600Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T11:27:47.338065Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.338065Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:467cbc671d193fc1bcad16dc4355c3cd63a4f5076418a63732c69249baa9b77f","observation_id":"b091d066-6201-4946-a08c-2e603dcaceda","resolution":{"observed_at":"2026-08-07T11:27:47.338065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24621","last_updated":"2026-05-31T10:26:22Z","snapshot_observed_at":"2026-08-08T13:44:42.764811Z","submitted_at":"2025-05-30T14:12:07Z","title":"Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24621","snapshot_observed_at":"2026-08-07T11:27:47.346115Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.346115Z"},"links":{"cited_paper":"/paper/2505.24621","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:2891aee3e30c537d90ab7c95d43cdabb6d118373fc1841f1d9b7f36403982bfd","observation_id":"642d42cb-e567-4d53-81b7-f1669b2ff556","resolution":{"observed_at":"2026-08-07T11:27:47.346115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09420","last_updated":"2025-04-13T03:36:06Z","snapshot_observed_at":"2026-08-09T11:45:26.904136Z","submitted_at":"2025-04-13T03:36:06Z","title":"SaRO: Enhancing LLM Safety through Reasoning-based Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09420","snapshot_observed_at":"2026-08-07T11:27:47.354047Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.354047Z"},"links":{"cited_paper":"/paper/2504.09420","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:306c2473d553f35f41f01bbd26264577c278064b871071022fed18c52ff8bf00","observation_id":"855c9b16-6bc5-494d-a596-913432d3e6df","resolution":{"observed_at":"2026-08-07T11:27:47.354047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.14301","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.069365Z","title":null,"venue":null,"work_id":"9ed213c4-ed6e-4c70-9204-a8adfb311836","year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.369437Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:fe0512a5269170e7539410db8be7f6d76022baed84de0dbdc5df16b2c061a00b","observation_id":"e83d5f35-8bbc-474d-88e1-43945ded8fd0","resolution":{"observed_at":"2026-08-07T11:27:48.173546Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.375342Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.375342Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:578ad77189a715858c67cc9e989cc709467583f3407dd56733c50e84b0df8863","observation_id":"e64ce843-07d1-48f9-a367-3428c3f2529b","resolution":{"observed_at":"2026-08-07T11:27:47.375342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.381480Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.381480Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:49932c2f86f62990b2c25972567a149a6e64328289037a9a4edb43f008b6b6de","observation_id":"ccd256c9-e1ec-46b8-ada0-20f9e9743acd","resolution":{"observed_at":"2026-08-07T11:27:47.381480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.325016Z","title":null,"venue":null,"work_id":"d748205a-0cb9-45fb-902f-a1e1a157fcf8","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.386841Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:e50d5d9790973d578bd583f251d9996787414d9e58127af0dcb1037691857c4f","observation_id":"cf9f0039-c899-41fd-96e7-deba8fd39018","resolution":{"observed_at":"2026-08-07T11:27:49.399243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.393410Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.393410Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:607cd5ab2774e35a1aaa94fb6ec6d4fabe907bcf5cfdafae63f5c38fc0f033e7","observation_id":"97a19b08-9b36-452a-b4f3-21651ea0bb56","resolution":{"observed_at":"2026-08-07T11:27:47.393410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.223083Z","title":null,"venue":null,"work_id":"689ad9f0-bafc-44e7-b350-84ac8ed28089","year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.399564Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:500a4dff2694a96bd1fce6f5d4208a947362bb790955f60c2b00c3afd432c0a8","observation_id":"9b9643af-eeed-44d3-97cf-291528fbb9bd","resolution":{"observed_at":"2026-08-07T11:27:49.272487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:27:47.405477Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.405477Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5ffa5078d01242b2d86ef2c4c735ea0d6e9b8b58cff1d89d0d816776e695f0b9","observation_id":"28416321-807b-4036-978f-a1716094620e","resolution":{"observed_at":"2026-08-07T11:27:47.405477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.412052Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.412052Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:beed9ad21f6ef53ee393637b02eb771f5db2215e3144927eea29896cbeb4fc17","observation_id":"3299d20c-9e50-4068-9f5b-e6512fbb7019","resolution":{"observed_at":"2026-08-07T11:27:47.412052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.418202Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.418202Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:47dcf973c05523e7c8460ea379ced28fdab17b825d86825fab9f14d8351fbaf8","observation_id":"83349e79-5cd6-4017-b2b7-2d15e981583f","resolution":{"observed_at":"2026-08-07T11:27:47.418202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.424467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.424467Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:42ee276695e95031c2e96079ba6f5f28ae589344a73e736131bb78a5cc33922f","observation_id":"210a72bd-66f7-41e1-b106-a2140787b95f","resolution":{"observed_at":"2026-08-07T11:27:47.424467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.945836Z","title":null,"venue":null,"work_id":"fa21abea-67b8-4fe5-8b21-e6ac750c02f9","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.430319Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:a36e1e120922f746471601a173b91afae1681f85f4bbed63f4b381ac2ccaf3d9","observation_id":"cfd2488b-dc86-4db2-b031-d07166648d10","resolution":{"observed_at":"2026-08-07T11:27:49.018405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.435792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.435792Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d2595c8d96adab20b702fa0db9e6a7d4389ae61c8312d8da1c0c4b6f24c6f5aa","observation_id":"3f819ca3-cc5c-413f-bf67-8f459f50fc71","resolution":{"observed_at":"2026-08-07T11:27:47.435792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.443024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.443024Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:1cbafbde4d7fe7ce700f94a5464120762132ae9af041f0792d3dd15508a2ff89","observation_id":"309629fa-7449-4a7c-9598-8fb71354e27a","resolution":{"observed_at":"2026-08-07T11:27:47.443024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.449114Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.449114Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:ca4a3358649f766720a67517c6d83fda279ec3135737b1edc3e985cc73c33e6b","observation_id":"b54cedb5-02a6-4160-b10b-f12f9acbbc3f","resolution":{"observed_at":"2026-08-07T11:27:47.449114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.454913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.454913Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:c753d1789855965e7b897395d8cdd6040b17729eb9d53b06692ebbcbf1320394","observation_id":"c32352f6-5eb5-42a8-8ed4-8f8deedc95e8","resolution":{"observed_at":"2026-08-07T11:27:47.454913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.461431Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.461431Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:8057a7e17549e44522b7f03abb0b574c609ee879aa34f6489b3489601bc554ed","observation_id":"4e57b8c6-f9cd-4a4b-b2f0-07c74fd00440","resolution":{"observed_at":"2026-08-07T11:27:47.461431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T11:27:47.467267Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.467267Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:12617f815af47395ff656355f4e38329a2c2fcf8e8ed91447880ccfa4665fd7f","observation_id":"86e2506d-b829-49ed-8cf4-cd50cc697115","resolution":{"observed_at":"2026-08-07T11:27:47.467267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.475035Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.475035Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:569915f204fb04945a052366abd264b95a1dd323062db767aabc7a6b234dc2a9","observation_id":"411437fe-d19a-48b6-a933-82d84bff3c92","resolution":{"observed_at":"2026-08-07T11:27:47.475035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.482807Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.482807Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:45332fec8f382be53997e09fc48ec1c8e56eed1ed5f4a2e37940343013329c13","observation_id":"4d16e431-eaa6-413b-a14e-88b605b2ba9d","resolution":{"observed_at":"2026-08-07T11:27:47.482807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2506.02442."}