{"as_of":"2026-08-08T16:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea89d86cab844a68f7abf4b35f980513057d04971533508924ac36c4a6bb95f5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:41:03.251847Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:10:09.315037Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2404.09005","last_updated":"2026-05-04T06:38:56Z","snapshot_observed_at":"2026-07-06T17:59:46.583076Z","submitted_at":"2024-04-13T13:18:40Z","title":"Proof-of-Learning with Incentive Security","version":8},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-24T02:24:17.188754Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2404.09005"},"observation_digest":"sha256:ce89cab31e7c16298b29b0da5b7b13fc862972d2e9083c15f88c4e29cff4a3d1","observation_id":"26308fe6-5800-452c-9d4c-c15aaa28442c","resolution":{"observed_at":"2026-05-24T02:25:55.530098Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-07T15:41:03.251847Z","title":"Safetywashing: Do ai safety benchmarks actually measure safety progress?, 2024.URL https://arxiv","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14215","last_updated":"2026-07-08T13:57:53Z","snapshot_observed_at":"2026-08-08T10:01:26.451368Z","submitted_at":"2025-05-20T11:21:40Z","title":"Safety Degradation in AI Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:03.251847Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2505.14215"},"observation_digest":"sha256:300f68699b22a980fe0411aa4a281be746d97e895bc1f44d365e5ccf3a7747c8","observation_id":"f8fb76d6-0c93-4dd7-8984-47370e0825a7","resolution":{"observed_at":"2026-08-07T15:41:03.251847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-07T15:37:51.682677Z","title":"{EMAIL_ADDRESS}","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14534","last_updated":"2025-05-20T15:54:45Z","snapshot_observed_at":"2026-08-08T01:06:16.260989Z","submitted_at":"2025-05-20T15:54:45Z","title":"Lessons from Defending Gemini Against Indirect Prompt Injections","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:51.682677Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2505.14534"},"observation_digest":"sha256:84c755371daf1f6c3e80813aff626b8b44e00a90eeff73091bcd121683bbaf0c","observation_id":"e6b248f2-edd8-40a4-8578-c47c493949fc","resolution":{"observed_at":"2026-08-07T15:37:51.682677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-07T13:28:23.620979Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21828","last_updated":"2025-05-27T23:29:32Z","snapshot_observed_at":"2026-08-08T07:57:10.326286Z","submitted_at":"2025-05-27T23:29:32Z","title":"SAGE-Eval: Evaluating LLMs for Systematic Generalizations of Safety Facts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:23.620979Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2505.21828"},"observation_digest":"sha256:6a578c62651c6230540f04518212b5100396d3a5e23a88783912e9bed1702c42","observation_id":"46d58363-7caa-4c6c-86aa-ddf5c16ec44d","resolution":{"observed_at":"2026-08-07T13:28:23.620979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-06T19:18:40.663885Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-08T08:57:18.737151Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.663885Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:bad5b8440575f1f0df08708b14d1e8f818f99a9c027fa6d926375c20bfc3f24f","observation_id":"a53b041b-1dfd-4607-9626-78256768fe15","resolution":{"observed_at":"2026-08-06T19:18:40.663885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2604.06233","last_updated":"2026-04-03T13:53:23Z","snapshot_observed_at":"2026-07-06T22:54:44.656835Z","submitted_at":"2026-04-03T13:53:23Z","title":"Blind Refusal: Language Models Refuse to Help Users Evade Unjust, Absurd, and Illegitimate Rules","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-13T19:24:54.381722Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2604.06233"},"observation_digest":"sha256:4769ec520095e1c7478c37f82817b0c3d204dacb593d4875a57a6c793cfa556d","observation_id":"d43b1df5-5003-4882-82af-122502291098","resolution":{"observed_at":"2026-05-13T19:28:09.978058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2605.16282","last_updated":"2026-04-11T04:25:19Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-04-11T04:25:19Z","title":"Taxonomy and Consistency Analysis of Safety Benchmarks for AI Agents","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-21T01:42:55.693115Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2605.16282"},"observation_digest":"sha256:a0f72f3b01a29d2287e230b8bcaec8c445ba37f8f49c49df6ae1ef7a15edc011","observation_id":"905caca1-94da-40e4-9adc-a3a18b023ce9","resolution":{"observed_at":"2026-05-21T01:43:56.649657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2606.09809","last_updated":"2026-06-08T17:55:02Z","snapshot_observed_at":"2026-08-02T08:53:32.385821Z","submitted_at":"2026-06-08T17:55:02Z","title":"Evaluation Cards: An Interpretive Layer for AI Evaluation Reporting","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-27T16:11:36.483820Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2606.09809"},"observation_digest":"sha256:25dfbc8ca1a50bb264830b981b24811354c043810f362f475e8e621bbc067708","observation_id":"34045775-d44e-43ae-bedc-d26990cc8319","resolution":{"observed_at":"2026-07-03T02:07:33.268541Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2606.10720","last_updated":"2026-06-09T11:30:25Z","snapshot_observed_at":"2026-08-08T11:54:00.348122Z","submitted_at":"2026-06-09T11:30:25Z","title":"A Pigouvian Matchmaker Mechanism for De-escalating the AGI Race","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T11:03:42.443180Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2606.10720"},"observation_digest":"sha256:38507f033bc5e24e0dc48f7ec178ab0187c6b8f4f72892d2252c32f2e59584e1","observation_id":"855cb524-3d24-4c41-a8e0-c5cf607fc39b","resolution":{"observed_at":"2026-07-03T08:07:45.444019Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":"2407.21792","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-07-04T21:10:09.315037Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":"fd35e7b1-cc17-41e8-b857-f311b6dc7a00","year":2024},"citing_paper":{"arxiv_id":"2606.26057","last_updated":"2026-06-24T17:32:27Z","snapshot_observed_at":"2026-08-04T04:25:13.906537Z","submitted_at":"2026-06-24T17:32:27Z","title":"The Unfireable Safety Kernel: Execution-Time AI Alignment for AI Agents and Other Escapable AI Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T19:01:27.048159Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2606.26057"},"observation_digest":"sha256:8d74e80960fd16c35842e32957d4289acd8b8c9fbbc7188c61ca7ef6edb3e7b4","observation_id":"158fec31-5471-46d3-b6fe-18feee98accd","resolution":{"observed_at":"2026-07-04T21:10:09.316660Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-02T07:44:09.409118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09306","last_updated":"2026-07-30T11:40:45Z","snapshot_observed_at":"2026-08-02T23:59:13.473449Z","submitted_at":"2026-07-10T11:39:40Z","title":"Exposure is not manifestation: measurement target and output resolution jointly determine which behavioural-faithfulness evaluator wins","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T07:44:09.409118Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2607.09306"},"observation_digest":"sha256:197dd10daab66fed98ee5db039dc4c33cefc53cde3872423a402faa3d0b0f4f7","observation_id":"9230e5db-e968-4e5d-9114-e29c6ecd2680","resolution":{"observed_at":"2026-08-02T07:44:09.409118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.21792/citation-record","integrity":"/paper/2407.21792/integrity","json":"/paper/2407.21792/citation-record.json","paper":"/paper/2407.21792"},"outbound":[],"paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2407.21792."}