{"as_of":"2026-08-09T20:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2a7d4375620693984e9e6ea4919c4c1f839e8cce5cc1e8128f822ebeea33def","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:18:40.850181Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06282/citation-record","integrity":"/paper/2507.06282/integrity","json":"/paper/2507.06282/citation-record.json","paper":"/paper/2507.06282"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.708757Z","title":"GuardBench: A Large-Scale Benchmark for Guardrail Models","venue":null,"work_id":"7eb4acce-9d3f-4086-b7a6-7dcbf00ee49e","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.633982Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:358593f1b769ffa81e7a02112dc9a3b98165b72ef3bac0348ad4f69221863ce6","observation_id":"2c91e3e0-d55e-4ba2-af12-aebd325fadf1","resolution":{"observed_at":"2026-08-06T19:18:43.818607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.381438Z","title":"Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming,","venue":null,"work_id":"87918439-c1be-4028-9114-4337881e1d79","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.761731Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:4bf6c3a1ff364375fe18c1a8cd345b5f914f3a9b2a2c623280a53e02e70642cd","observation_id":"a52d6d52-2bd2-43c6-b438-7005ac68bff6","resolution":{"observed_at":"2026-08-06T19:18:43.563105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.117772Z","title":"NeurIPS 2024 Datasets and Benchmarks Track, 2024","venue":null,"work_id":"2ff2ccfb-3cb9-49a7-82e9-ac903dc8b185","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.810817Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:66a9244756c6a3c8a3ecebfffcb6fd5c1c01119fcb712bbdf68b48b0c12f0268","observation_id":"f8c82631-8dd1-4ee7-8b64-f927f3aa1a4a","resolution":{"observed_at":"2026-08-06T19:18:43.272682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-06T19:18:38.885620Z","title":"Do Anything Now","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.885620Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:90095caba98ed3175e9656748c812d5651254f90a552d8accce1140f4e10ba50","observation_id":"039fb256-65d4-4e2c-9e55-e0bbc9b68aee","resolution":{"observed_at":"2026-08-06T19:18:38.885620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14598","last_updated":"2025-03-01T21:45:36Z","snapshot_observed_at":"2026-07-06T18:34:29.513732Z","submitted_at":"2024-06-20T17:56:07Z","title":"SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14598","snapshot_observed_at":"2026-08-06T19:18:39.027078Z","title":"SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal Behaviors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.027078Z"},"links":{"cited_paper":"/paper/2406.14598","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:77a6d4beeda518fb84e3a0bb272d04bda830656061d377237d8fccafe7309abb","observation_id":"52615106-1ebe-4879-9046-de714e9e8211","resolution":{"observed_at":"2026-08-06T19:18:39.027078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.986399Z","title":"AdvBench: Universal and Transferable Ad- versarial Attacks on Aligned Language Models,","venue":null,"work_id":"346fd1f8-4aa3-4d4b-9326-fc7861d4c2ab","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.230798Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:9b2722faf3cf51c658cb954acba9bfbb5fc1cec1301f72ea52406615324fbaea","observation_id":"df1cfef7-9e07-4e97-95c8-dabb2346ac2e","resolution":{"observed_at":"2026-08-06T19:18:43.058381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.812500Z","title":"CatQA: A Dataset for Categorizing Questions as Safe or Unsafe,","venue":null,"work_id":"0c161e3b-693e-4d10-be7c-860bb03477ba","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.311873Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:625c61cf33ec68e8012781ad74f6df8a9a0b33ad9eba791282f8d9db94cabafe","observation_id":"23662cfe-a460-48e7-96b9-ee0dac2f98c2","resolution":{"observed_at":"2026-08-06T19:18:42.891885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.617027Z","title":"Do Not Answer: Testing AI Refusal to Unsafe Questions,","venue":null,"work_id":"4ec257bb-3eb0-4a59-8868-8f74aa1b5025","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.365817Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:220b5384c3993cde9eee7f3f167078e2d915efa568c19998432dacf28cf253b9","observation_id":"f1c918c9-da12-4d60-8c4e-c6abb5eddbd7","resolution":{"observed_at":"2026-08-06T19:18:42.701691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.341572Z","title":"HH-RLHF: Helpful and Harmless Reinforcement Learning from Hu- man Feedback,","venue":null,"work_id":"6966bb76-89db-4170-bbcd-420b2ad28186","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.472725Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:7d26b5f55204c01e64c3600f53294d11b37050f5afdba95624b327c763b43a4c","observation_id":"c0105b1f-cfac-43dd-8207-35d7d779c5c9","resolution":{"observed_at":"2026-08-06T19:18:42.506895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T19:18:39.588048Z","title":"BELLS: A Framework Towards Future Proof Benchmarks for the Evaluation of LLM Safeguards","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.588048Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:54931cc707c362920a01a0b7f83e25acb1d1a02a4484e80f51d69896b267f805","observation_id":"8543b09b-adba-4383-be52-c9d1d4dff676","resolution":{"observed_at":"2026-08-06T19:18:39.588048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-06T19:18:39.703539Z","title":"NeurIPS 2024 Datasets and Benchmarks Track, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.703539Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:fb2a4dc4ee2b1ee34bc156989f3d3dc1e3fa20e9e6ad566215b90df97ec34c3a","observation_id":"9a3352f7-c722-4e0a-92c8-3a166a2de097","resolution":{"observed_at":"2026-08-06T19:18:39.703539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.174225Z","title":"The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"76035d94-ffe2-4d92-b517-c10076cb54c7","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.798982Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:e373c0452811f6971feb403ec9d8943467eeda0f3845f3f9adc278e3a4aeaad6","observation_id":"f6b9e1a3-e909-4b4a-9aab-9f0e404c9aac","resolution":{"observed_at":"2026-08-06T19:18:42.239110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.932580Z","title":null,"venue":null,"work_id":"2f2db35a-91e1-42ed-b28d-1c8112ec0530","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.887601Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:3ac2dcf635743a07a0af8a9e2f41c380b626c4a9f6acdbf502778f96e03420d5","observation_id":"82e96a74-af9e-44c2-99d9-b2a6927de0eb","resolution":{"observed_at":"2026-08-06T19:18:42.037851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.625883Z","title":null,"venue":null,"work_id":"0fa2cb77-30a1-4f78-9035-0f44f5408b13","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.022590Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:e397cd4a52dce993c5075b2ec7d70ae86959421a683523e042f947a79d728eb6","observation_id":"219f32df-033c-482f-bf49-dc911055af8f","resolution":{"observed_at":"2026-08-06T19:18:41.743137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-06T19:18:40.154024Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.154024Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:79547204257cd11da3385ff3d9fde21b42073094aabd6efbac4efbe7c598d824","observation_id":"7efef56f-9ccc-4f3e-b0c4-589bac84fd58","resolution":{"observed_at":"2026-08-06T19:18:40.154024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T19:18:40.283148Z","title":"Zico and Fredrikson, Matt.Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.283148Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:a4f5d409ca8a5278c1be38de36d0a0104e06f6c56ef514a82e6a5374023203df","observation_id":"05f8fcb2-eb3f-441e-99f1-8a526aa9d2fe","resolution":{"observed_at":"2026-08-06T19:18:40.283148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T19:18:40.429244Z","title":"and Wong, Eric","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.429244Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:1d0cf685a2a1b58dca56d4b270dddcb410480da1a099dd8ab7dafceb61a93856","observation_id":"25f66079-b23c-41d8-b039-4b95459d3b93","resolution":{"observed_at":"2026-08-06T19:18:40.429244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06942","last_updated":"2024-07-23T06:47:13Z","snapshot_observed_at":"2026-08-09T00:10:06.167600Z","submitted_at":"2023-12-12T02:34:06Z","title":"AI Control: Improving Safety Despite Intentional Subversion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06942","snapshot_observed_at":"2026-08-06T19:18:40.580182Z","title":"arXiv preprint arXiv:2312.06942, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.580182Z"},"links":{"cited_paper":"/paper/2312.06942","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:778753ddf65d2073d7501302cb54496e70fc28e15bcd5da235c63c03bb84a527","observation_id":"cdba531b-0cde-4c13-b6f1-c526f77578c9","resolution":{"observed_at":"2026-08-06T19:18:40.580182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-06T19:18:40.663885Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.663885Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:bad5b8440575f1f0df08708b14d1e8f818f99a9c027fa6d926375c20bfc3f24f","observation_id":"a53b041b-1dfd-4607-9626-78256768fe15","resolution":{"observed_at":"2026-08-06T19:18:40.663885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.297943Z","title":"Is this prompt harmful or not?","venue":null,"work_id":"781de4c6-de43-4e65-bbc6-626fb142c7b0","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.850181Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:85ccc1a12723ae52c37906ef98c21ef77a7d378643390d392ef1c82fc1051f93","observation_id":"15b373f1-d82b-4fc5-b86b-a2de051580f3","resolution":{"observed_at":"2026-08-06T19:18:41.442675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.06282."}