{"as_of":"2026-08-20T07:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e883715ddcf93343f3a904f8328891b90f42a581fe6f7d2e86c81615e1124444","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T13:23:22.708604Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.10226/citation-record","integrity":"/paper/2607.10226/integrity","json":"/paper/2607.10226/citation-record.json","paper":"/paper/2607.10226"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-08-17T07:39:23.832733Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Trenton Bricken, Adly Templeton, Joshua Batson, Brian Chen, Adam Jermyn, Tom Conerly, Nicholas L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:21bfe933e12ccc6f4d1a84e791b6c0b6a16288b0704f512435108d60d0d1ecff","observation_id":"cf4ded39-27c8-4b13-ac80-12b0a360004d","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Hoagy Cunningham, Aidan Ewart, Logan Riggs, Robert Huben, and Lee Sharkey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:9daef564dc3d4c7eadc506a1a9f38415eabc40f9709040c486cc7bf810844587","observation_id":"8ec33f83-6c48-449f-8bf7-0c651fe993d9","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Abhimanyu Dubey, Abhinav Jauhri, Abhinav Pandey, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:754e998beba4004a765aae8d3342a0d810956771397b15904a2c750cca819bdb","observation_id":"97537d91-5005-47c6-9585-ee8f53865476","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:9cf52fc86c584d77cf69ce3aa981913a0b1df6a8d74d5a99137c206eee77d377","observation_id":"538b963b-2a7d-41fe-ac9e-80a08fa3bca6","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17713","last_updated":"2024-11-18T21:42:17Z","snapshot_observed_at":"2026-08-14T01:19:34.244147Z","submitted_at":"2024-11-18T21:42:17Z","title":"Llama Guard 3-1B-INT4: Compact and Efficient Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17713","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Gemma Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2411.17713","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:206e2b5905c34735a64fd92b20808aaaa8e316a30b6f7c577b3d8fd8564e0c1c","observation_id":"794b1101-7735-42a0-a3d8-a53e13c7148a","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Zhengfu He, Wentao Shu, Xuyang Ge, Lingjie Chen, Junxuan Wang, Yunhua Zhou, Frances Liu, Qipeng Guo, Xuanjing Huang, Zuxuan Wu, Yu-Gang Jiang, and Xipeng Qiu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:7e90e9d44fd891cb13d88d010b8f0006a29f497f3f291067da946e7639196f1e","observation_id":"9854b652-f25d-4651-8f55-1cc62a74f677","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-20T06:06:39.277314Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:26d2e904aa745d2a06d4bf54e9ffedd2a0cf81dcbf9b7d5123cdea8b3d1ea8d1","observation_id":"60b03b10-a014-49a2-907e-824206c2bffa","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Liwei Jiang, Kavel Rao, Seungju Han, Allyson Ettinger, Faeze Brahman, Sachin Kumar, Niloofar Mireshghallah, Ximing Lu, Maarten Sap, Yejin Choi, and Nouha Dziri","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:f4a7c3cf7938e355809d8a45e5b82ed601c4b731f1e126c963a7a92c9c11247e","observation_id":"bd962976-c7e0-4b71-9f83-010c868e279c","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18510","last_updated":"2024-06-26T17:31:22Z","snapshot_observed_at":"2026-08-16T13:39:21.038674Z","submitted_at":"2024-06-26T17:31:22Z","title":"WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18510","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Tom Lieberum, Senthooran Rajamanoharan, Arthur Conmy, Lewis Smith, Nicolas Sonnerat, Vikrant Varma, Janos Kramar, Anca Dragan, Rohin Shah, and Neel Nanda","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2406.18510","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:112aacd576eb8fbca2dcfc8b321c3fa2066cdfc0dbfdc458a73e3ab34fde2697","observation_id":"2e1d3879-bf63-4e4d-b305-87c584e031db","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"21 Mantas Mazeika, Long Phan, Xuwang Yin, Andy Zou, Zifan Wang, Norman Mu, Elham Sakhaee, Nathaniel Li, Steven Basart, Bo Li, David Forsyth, and Dan Hendrycks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:389249ab77eea5e3c0a61e02c21796c5d1d545302028c38de28c3a29a2b7eb80","observation_id":"81b2608a-47c8-4ec4-9b14-1a2c108bec51","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Paul Rottger, Hannah Rose Kirk, Bertie Vidgen, Giuseppe Attanasio, Federico Bianchi, and Dirk Hovy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:a077aac6bff45dac29fd254e5fc03947506d984c23d200b41586e09f0bd3a604","observation_id":"f57db782-a748-44c2-89dc-ecb498631e99","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01263","last_updated":"2024-04-01T11:50:35Z","snapshot_observed_at":"2026-08-14T04:19:38.572552Z","submitted_at":"2023-08-02T16:30:40Z","title":"XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01263","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Alexander Matt Turner, Lisa Thiergart, Gavin Leech, David Udell, Juan J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2308.01263","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:5fadfe9cd3aeb06456f6b68726a791479edc1b69afc4815cbbd01ee24350d8b2","observation_id":"cecc21b7-45be-4dc0-8944-977367f56a2b","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, Shashwat Goel, Nathaniel Li, Michael J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:3260299616b405381ef5f8a6c4d15557fe98d61ec4dca854d3baab1b271f2a91","observation_id":"69d632b0-843a-4e42-adc5-1abec4b73da1","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:e063d55c1560f5d3972bcb1f2c54d617d628e4913142f3815cc61c42b35e7fb4","observation_id":"dba96bb6-5e97-4caf-91c9-d146da754562","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T15:54:05.346755Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2607.10226."}