{"as_of":"2026-08-09T09:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37faa5b0901fd5b5d772e550568bbf61629741ce5127bb81fc61f2b37ecb5a3e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:29.746277Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-07T15:42:29.746277Z","title":"Xingyu Fu, Yushi Hu, Bangzheng Li, Yu Feng, Haoyu Wang, Xudong Lin, Dan Roth, Noah A Smith, Wei-Chiu Ma, and Ranjay Krishna","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14071","last_updated":"2025-05-20T08:23:08Z","snapshot_observed_at":"2026-08-08T01:07:30.794755Z","submitted_at":"2025-05-20T08:23:08Z","title":"Textual Steering Vectors Can Improve Visual Understanding in Multimodal Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:29.746277Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2505.14071"},"observation_digest":"sha256:468e14bb739d047317fa89be501ed07b55d6828bf2862f7c8288d7d3642b3b7b","observation_id":"1853cc4c-7d87-4f40-9ec0-ad89cb879819","resolution":{"observed_at":"2026-08-07T15:42:29.746277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-07T15:30:20.974878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.974878Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:6eba4200a34387575094a142ce4d745ba8b71ae7b295f6fd4e8001418446416e","observation_id":"94e961d9-3a53-49b2-8fec-3af767e6ca5e","resolution":{"observed_at":"2026-08-07T15:30:20.974878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-07T15:04:54.221963Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16505","last_updated":"2025-05-22T10:41:35Z","snapshot_observed_at":"2026-08-07T14:57:29.065655Z","submitted_at":"2025-05-22T10:41:35Z","title":"Sparse Activation Editing for Reliable Instruction Following in Narratives","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:04:54.221963Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2505.16505"},"observation_digest":"sha256:254e33e9f653bf18388124dcc8a182f684c65271372cdb81d0f368ddedc0760b","observation_id":"99027462-288b-4c00-9c68-0b8855948faa","resolution":{"observed_at":"2026-08-07T15:04:54.221963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-07T12:51:06.049313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23556","last_updated":"2025-05-29T15:33:39Z","snapshot_observed_at":"2026-08-07T12:41:07.052091Z","submitted_at":"2025-05-29T15:33:39Z","title":"Understanding Refusal in Language Models with Sparse Autoencoders","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:06.049313Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2505.23556"},"observation_digest":"sha256:efb88d2c825470a8875b4a8bc629d59dbba69013dfd8df85e817b34fc2b3fad2","observation_id":"27ce27a2-0f7e-4a85-a82d-5cf9a0b595d9","resolution":{"observed_at":"2026-08-07T12:51:06.049313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-06T16:40:42.108171Z","title":"L lama S cope: Extracting millions of features from Llama-3.1-8B with sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12950","last_updated":"2025-07-18T09:19:19Z","snapshot_observed_at":"2026-08-08T08:02:10.889574Z","submitted_at":"2025-07-17T09:43:20Z","title":"Insights into a radiology-specialised multimodal large language model with sparse autoencoders","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:40:42.108171Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2507.12950"},"observation_digest":"sha256:f44f7a429b980f8e245e6bb8c212751407b30e568893bd9cff4ee815d4917705","observation_id":"ee6988e0-3b75-47fa-9cb6-4de7304ae0a9","resolution":{"observed_at":"2026-08-06T16:40:42.108171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-06T16:40:28.821951Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12990","last_updated":"2025-07-17T10:57:49Z","snapshot_observed_at":"2026-08-08T10:53:21.043716Z","submitted_at":"2025-07-17T10:57:49Z","title":"Teach Old SAEs New Domain Tricks with Boosting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:40:28.821951Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2507.12990"},"observation_digest":"sha256:7b1b865b81a9ad5f912b6c94287749b27dc6a49d069b237f7dbd2684112661d7","observation_id":"1d60d8f4-3f94-4fa9-b990-187622944869","resolution":{"observed_at":"2026-08-06T16:40:28.821951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-06T16:29:06.640938Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14240","last_updated":"2025-09-04T23:06:49Z","snapshot_observed_at":"2026-08-06T17:05:25.092503Z","submitted_at":"2025-07-17T17:34:13Z","title":"HuggingGraph: Understanding the Supply Chain of LLM Ecosystem","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:29:06.640938Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2507.14240"},"observation_digest":"sha256:7926ce7d3a134b16e0e162d0de3fe26287348e1ff5f0ecfa8394289d7aac4538","observation_id":"d074ad7b-8464-4353-9933-b3673759462e","resolution":{"observed_at":"2026-08-06T16:29:06.640938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-06T15:42:41.140534Z","title":"arXiv preprint arXiv:2410.20526 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15227","last_updated":"2025-08-15T19:18:28Z","snapshot_observed_at":"2026-08-06T15:35:12.417146Z","submitted_at":"2025-07-21T03:59:21Z","title":"Mammo-SAE: Interpreting Breast Cancer Concept Learning with Sparse Autoencoders","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:42:41.140534Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2507.15227"},"observation_digest":"sha256:e1ad972230e7678e3bc32b1bf76253672d310dd857ff9edfb5379d921e8ff217","observation_id":"a6a57966-1046-450d-a424-a88a58420bd7","resolution":{"observed_at":"2026-08-06T15:42:41.140534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T17:26:48.585241Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders.arXiv preprint arXiv:2410.20526, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16318","last_updated":"2025-09-01T08:35:27Z","snapshot_observed_at":"2026-08-07T01:49:06.395378Z","submitted_at":"2025-08-22T11:57:55Z","title":"SATORI: Static Test Oracle Generation for REST APIs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T17:26:48.585241Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.16318"},"observation_digest":"sha256:65f48c97249ca65d74e7b96ace964d0da6f89d9cb66b533ae8837218fa3985f9","observation_id":"4bc6fdef-2e70-4549-a5b4-d1e4717be92c","resolution":{"observed_at":"2026-08-05T17:26:48.585241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T17:16:33.055842Z","title":"URL https: //doi.org/10.48550/arXiv.2410.20526","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16930","last_updated":"2025-08-23T07:30:18Z","snapshot_observed_at":"2026-08-07T20:59:21.703704Z","submitted_at":"2025-08-23T07:30:18Z","title":"HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:16:33.055842Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.16930"},"observation_digest":"sha256:1e356ca0318136b419151e54d36e2612184e09acdb4e3dde82737e33a876d128","observation_id":"5698882d-c7a7-4f81-98df-faad84fcd714","resolution":{"observed_at":"2026-08-05T17:16:33.055842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T14:22:30.595697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21448","last_updated":"2026-06-02T08:58:05Z","snapshot_observed_at":"2026-08-08T19:08:05.458118Z","submitted_at":"2025-08-29T09:27:01Z","title":"When Models Refuse: Political Steerability and Feature Richness as Measures of Ideological Depth","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:22:30.595697Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2508.21448"},"observation_digest":"sha256:b27b129cfb0f7faaa3381b7c415c0c8a9665949d61ce5bc26a0e3af71536deda","observation_id":"5e0bcefc-5bed-41ad-9f0d-67f3aa10abcc","resolution":{"observed_at":"2026-08-05T14:22:30.595697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2509.18127","last_updated":"2026-04-14T10:00:44Z","snapshot_observed_at":"2026-08-02T17:25:00.233548Z","submitted_at":"2025-09-11T11:22:43Z","title":"Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-18T18:13:01.662828Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2509.18127"},"observation_digest":"sha256:784853310dba5855a0787dbbd4068a2ced01753eba7b3adf8fb8423cbf3072e6","observation_id":"b7efdee6-ed2f-45ee-89f0-9a8a067e5e4b","resolution":{"observed_at":"2026-05-18T18:16:43.753837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T15:20:32.165968Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.20784","last_updated":"2026-05-29T09:11:25Z","snapshot_observed_at":"2026-08-08T01:29:27.853337Z","submitted_at":"2025-09-25T06:13:05Z","title":"Towards Atoms of Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T15:20:32.165968Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2509.20784"},"observation_digest":"sha256:247b017cc6bfebd3bd47103d8cdb96f2cdc7197413ca3e2796f707dae9e4f1c1","observation_id":"f7debc33-1c98-417d-9279-3b3b7223897b","resolution":{"observed_at":"2026-08-04T15:20:32.165968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:b186ee456b6baff548d91d31cd0280b850635bdcc7c6b4159e8f925d32736d76","observation_id":"1491b3f6-15cd-40b5-91be-a605761b234d","resolution":{"observed_at":"2026-05-16T12:40:54.699308Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-03T06:35:33.800432Z","title":"Hindupur, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.22594","last_updated":"2026-06-11T01:15:40Z","snapshot_observed_at":"2026-08-07T12:49:34.817408Z","submitted_at":"2026-01-30T05:41:19Z","title":"Language Model Circuits Are Sparse in the Neuron Basis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T06:35:33.800432Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2601.22594"},"observation_digest":"sha256:c6e223a642a092036939ee42e708aa25346ab480cb0e0b46e27d33c123664f9a","observation_id":"6a47acc6-3553-492c-ac78-6c0fc4987e5a","resolution":{"observed_at":"2026-08-03T06:35:33.800432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-03T01:14:58.085415Z","title":"Ghandeharioun, A., Caciularu, A., Pearce, A., Dixon, L., and Geva, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.10352","last_updated":"2026-06-02T04:32:29Z","snapshot_observed_at":"2026-08-06T01:08:22.482910Z","submitted_at":"2026-02-10T22:50:02Z","title":"Learning Self-Interpretation from Interpretability Artifacts: Training Lightweight Adapters on Vector-Label Pairs","version":2},"reference_index":600,"source":"pdf_text","source_observed_at":"2026-08-03T01:14:58.085415Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2602.10352"},"observation_digest":"sha256:db39bccb51f704809d54a1ca633185512daff2001ccd55cb17c5cc367dc9787c","observation_id":"feddd9b1-463e-42c8-acff-10c4c15954d3","resolution":{"observed_at":"2026-08-03T01:14:58.085415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T05:36:47.887167Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03532","last_updated":"2026-08-02T18:42:26Z","snapshot_observed_at":"2026-08-09T06:27:07.453165Z","submitted_at":"2026-04-04T00:56:13Z","title":"LangFIR: Discovering Sparse Language-Specific Features from Monolingual Data for Language Steering","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T05:36:47.887167Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.03532"},"observation_digest":"sha256:132c97618b185e36b15f79aa6ab318d832ea3e348985eb2687779135f8f74602","observation_id":"dca8806d-4c3a-4414-a648-faff8fc52a49","resolution":{"observed_at":"2026-08-04T05:36:47.887167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.11297","last_updated":"2026-04-13T10:59:28Z","snapshot_observed_at":"2026-08-06T09:35:43.508314Z","submitted_at":"2026-04-13T10:59:28Z","title":"The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:31.715954Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.11297"},"observation_digest":"sha256:ee86e679be668ea020a020cf792da5a21bf3cf4d98c09e273eae7e6b671aa6f8","observation_id":"01801f0c-9b33-4699-b891-51ecca4002d3","resolution":{"observed_at":"2026-05-10T15:35:32.765091Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.14090","last_updated":"2026-04-15T17:06:25Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T17:06:25Z","title":"From Weights to Activations: Is Steering the Next Frontier of Adaptation?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T12:52:58.193141Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.14090"},"observation_digest":"sha256:87920ee17d921ee9f88ffec4f1c39739ff9af9c9b4408f1fa4a1b052133c9bc4","observation_id":"b2b331e2-e670-4319-a9fb-8dce35d6a686","resolution":{"observed_at":"2026-05-10T12:55:24.615581Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.19974","last_updated":"2026-04-21T20:34:14Z","snapshot_observed_at":"2026-07-06T23:06:31.110859Z","submitted_at":"2026-04-21T20:34:14Z","title":"Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T02:51:12.492123Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.19974"},"observation_digest":"sha256:450b53e176a146caf3fdbab64023948f8ba45bea0327c027442a470e4e0a2bf9","observation_id":"fc9ee04c-7102-4d90-96b3-9762fdfc9708","resolution":{"observed_at":"2026-05-10T02:53:29.657509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2604.23877","last_updated":"2026-04-26T20:37:26Z","snapshot_observed_at":"2026-07-06T23:10:02.659384Z","submitted_at":"2026-04-26T20:37:26Z","title":"Knowledge Vector of Logical Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T06:02:28.444902Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2604.23877"},"observation_digest":"sha256:31686a8bc91f51fdccec2ae52a81257f8950b3c8e3421ff022a020976bbe8b83","observation_id":"0c2306d6-a71d-435a-b291-185108bad2fb","resolution":{"observed_at":"2026-05-11T21:16:32.876799Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.02234","last_updated":"2026-05-04T05:09:21Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T05:09:21Z","title":"Bucketing the Good Apples: A Method for Diagnosing and Improving Causal Abstraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T19:12:30.627633Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.02234"},"observation_digest":"sha256:9bfa84f9ca9cbb8fcb38dc0ec365fc2c5f9a2435edf2f210f82eeeca3f80ca4c","observation_id":"e7682740-a95d-43ff-a262-27a7b1e7cd8e","resolution":{"observed_at":"2026-05-09T06:00:36.281729Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03052","last_updated":"2026-05-29T18:13:59Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:17:05Z","title":"How Language Models Process Negation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-08T18:28:29.824790Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03052"},"observation_digest":"sha256:9bfeacbd249b969bf958262fca591c3e1535e6162a08e05b341baa7bb23470a8","observation_id":"5e323262-9627-4746-8f89-d802ab54aa8d","resolution":{"observed_at":"2026-05-09T06:25:45.389251Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03052","last_updated":"2026-05-29T18:13:59Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:17:05Z","title":"How Language Models Process Negation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T00:10:03.686212Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03052"},"observation_digest":"sha256:6e3a8abd102ab1f04360930a33330c67d8c6c2203cb8fdc21b0a58b6619f76f9","observation_id":"1412c016-d18f-4dd4-a764-2351ea339a63","resolution":{"observed_at":"2026-07-01T00:15:09.371689Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.03160","last_updated":"2026-07-25T20:25:34Z","snapshot_observed_at":"2026-08-02T14:57:38.720241Z","submitted_at":"2026-05-04T21:11:21Z","title":"Steering grids for sparse-autoencoder features: when a top-context label names an activation regime rather than a causal axis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T18:52:01.624279Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03160"},"observation_digest":"sha256:216943bb87a1a8b9e4a93d29c9811f4f1f8912b535d96ab5eb89202380e2cd51","observation_id":"a6d8e159-28d7-437e-b541-8774363c8e87","resolution":{"observed_at":"2026-05-09T06:10:37.078332Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-02T14:57:40.198964Z","title":"Kenneth Li, Oam Patel, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.03160","last_updated":"2026-07-25T20:25:34Z","snapshot_observed_at":"2026-08-02T14:57:38.720241Z","submitted_at":"2026-05-04T21:11:21Z","title":"Steering grids for sparse-autoencoder features: when a top-context label names an activation regime rather than a causal axis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T14:57:40.198964Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.03160"},"observation_digest":"sha256:494805464dea8607414198558d0f275736b7e16dda58ee442a107dc962427094","observation_id":"2b9d8e00-97e1-455c-b3b2-eb8556d2584f","resolution":{"observed_at":"2026-08-02T14:57:40.198964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.12874","last_updated":"2026-05-13T01:41:38Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T01:41:38Z","title":"Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:38.363693Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.12874"},"observation_digest":"sha256:4f42d5de27bf8342322c04dda8c1b34fd514f9136dad6f13165a4c3c5b5fa01f","observation_id":"844ab031-b11e-491b-98fb-cfd37c219db2","resolution":{"observed_at":"2026-05-14T20:27:58.939127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.23036","last_updated":"2026-05-21T21:00:32Z","snapshot_observed_at":"2026-08-02T00:36:01.688932Z","submitted_at":"2026-05-21T21:00:32Z","title":"Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T05:35:04.688774Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.23036"},"observation_digest":"sha256:d7c3c57642b6d7bdd08bafaf80e32b7f47c32687e56d799ec42b54e1f379e5b7","observation_id":"3fd20e04-d2c2-4da1-8562-72a8335a1a12","resolution":{"observed_at":"2026-05-25T05:36:39.343151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.27819","last_updated":"2026-05-27T01:27:53Z","snapshot_observed_at":"2026-07-06T23:37:31.844094Z","submitted_at":"2026-05-27T01:27:53Z","title":"ReSAE: Residualized Sparse Autoencoders for Multi-Layer Transformer Interventions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T14:53:40.774927Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.27819"},"observation_digest":"sha256:2f69d0e2b2020e54dbddbf66621a56501b54122c2fde2d527c406af07b432897","observation_id":"353ca87a-e502-4550-bac0-9ee30ab4cf4b","resolution":{"observed_at":"2026-06-29T15:03:31.590058Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:71c5158e5c9c5f4f66e7f34fd8daf8a8b63d6efd82e21f4bc32b503b4ffd7e97","observation_id":"d250513c-cd86-4bf2-8496-939a085faab0","resolution":{"observed_at":"2026-06-29T14:23:30.743712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-04T05:02:51.322308Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.322308Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:87e71d9196b8cd7982974e3a13f78c6c74ef062d3b5960e0db0b24f0d2749b9f","observation_id":"9a2027af-1fd8-47ee-bdfa-59c6a4b40419","resolution":{"observed_at":"2026-08-04T05:02:51.322308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2605.28649","last_updated":"2026-05-27T15:52:39Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T15:52:39Z","title":"Interpretability-Guided Layer Selection over Subspace Projection: SAEs as Stethoscopes, Not Scalpels, for Raw Task Vector Model Editing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T14:00:31.962058Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2605.28649"},"observation_digest":"sha256:856c56c58426f0ca69f8fc5b341d8f3894e571a19fb4c601c5081b19f6c9c030","observation_id":"61b68d60-8695-47bb-bbbd-ad7bc12dd4d0","resolution":{"observed_at":"2026-06-29T14:03:29.443692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.00356","last_updated":"2026-06-03T03:59:07Z","snapshot_observed_at":"2026-08-01T16:45:43.116377Z","submitted_at":"2026-05-29T20:59:28Z","title":"How Far Do Auto-Interpretation Labels Generalize: A Controlled Study Across Languages, Scripts, and Rewordings","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T22:02:13.297140Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.00356"},"observation_digest":"sha256:8f7dc7dfda41b605c84c947c7db5517420e3a6706d905db449f73a397f099bfc","observation_id":"af4d1441-e7e8-4c56-99fd-494dd62c61f4","resolution":{"observed_at":"2026-07-01T19:46:11.043660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.08267","last_updated":"2026-06-06T17:27:38Z","snapshot_observed_at":"2026-07-06T23:47:48.634024Z","submitted_at":"2026-06-06T17:27:38Z","title":"Post-AGI Economies: Superposition and the Second Fundamental Theorem of Welfare Economics","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T18:56:37.173132Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.08267"},"observation_digest":"sha256:90adb0f75747e26c376599a69b532fb4a7ac31a6b2aed04a6fa5a3235c7cea82","observation_id":"268b9d15-03fd-4494-a92f-09cb4f3094a8","resolution":{"observed_at":"2026-07-02T22:27:25.653185Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2606.26620","last_updated":"2026-06-25T05:33:03Z","snapshot_observed_at":"2026-08-07T13:16:24.780198Z","submitted_at":"2026-06-25T05:33:03Z","title":"Discovering Millions of Interpretable Features with Sparse Autoencoders","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T05:34:00.754172Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2606.26620"},"observation_digest":"sha256:7c0ae77cb430927f1a9042ace9c8ac14be68e8527040d6e6f406b974ef1aafe4","observation_id":"8968abbf-079b-4376-b671-7c33051b203f","resolution":{"observed_at":"2026-07-04T12:59:53.068921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":"2410.20526","doi":"10.48550/arxiv.2410.20526","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Armand Joulin, Edouard Grave, Piotr Bojanowski, Matthijs Douze, Hérve Jégou, and Tomas Mikolov","venue":"arXiv (Cornell University)","work_id":"7aaa8958-6923-46a6-99cd-533ced88a8b2","year":2024},"citing_paper":{"arxiv_id":"2607.00397","last_updated":"2026-07-01T03:48:49Z","snapshot_observed_at":"2026-08-06T09:57:01.183474Z","submitted_at":"2026-07-01T03:48:49Z","title":"NeuroCogMap Reveals Cognitive Organization of Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-02T02:36:32.233113Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.00397"},"observation_digest":"sha256:f22af1aa3724588df03cf918ed2d0f6fc312db4057f021b4a0a74a285f501dde","observation_id":"88194d69-50b9-4d5e-b068-383929996362","resolution":{"observed_at":"2026-07-02T02:46:27.620414Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-07-14T13:23:22.708604Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10226","last_updated":"2026-07-11T09:31:45Z","snapshot_observed_at":"2026-08-02T08:49:17.463451Z","submitted_at":"2026-07-11T09:31:45Z","title":"When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T13:23:22.708604Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.10226"},"observation_digest":"sha256:488f87db92ed54913a6ef3e5469ef8a7e7aeda6c99016e8a0103d3a7f8d2a08a","observation_id":"60b03b10-a014-49a2-907e-824206c2bffa","resolution":{"observed_at":"2026-07-14T13:23:22.708604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T10:03:56.027290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20596","last_updated":"2026-07-22T17:33:16Z","snapshot_observed_at":"2026-08-09T06:27:26.743612Z","submitted_at":"2026-07-22T17:33:16Z","title":"Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T10:03:56.027290Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.20596"},"observation_digest":"sha256:eabe9333399d728025772dde71b92be8abac17a29ab8bd765926cd52d5a87437","observation_id":"b5f720c7-61e1-47f8-a0ca-3c7110429a39","resolution":{"observed_at":"2026-08-01T10:03:56.027290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T03:00:44.868666Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25270","last_updated":"2026-07-28T04:18:24Z","snapshot_observed_at":"2026-08-07T23:12:57.442792Z","submitted_at":"2026-07-28T04:18:24Z","title":"Where Steering Signals Come From: Activation Source Selection in Activation Steering","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T03:00:44.868666Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.25270"},"observation_digest":"sha256:ed3fb599934a63394aad2de3b9e0d6f584a8b359342d1e9d2f44cbfd8eef1290","observation_id":"a323459e-dba7-4de9-9f43-9d2a1f96896d","resolution":{"observed_at":"2026-08-01T03:00:44.868666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-01T01:13:36.771985Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25907","last_updated":"2026-07-28T16:01:48Z","snapshot_observed_at":"2026-08-09T01:52:42.121295Z","submitted_at":"2026-07-28T16:01:48Z","title":"Minimizing Targeted Activations: Input-Only Suppression of Evaluation-Awareness Latents in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T01:13:36.771985Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2607.25907"},"observation_digest":"sha256:853c78f189ada2a93dad66582df8809451bf984948f077421e150be9de3a0b92","observation_id":"fcf4e245-00ab-4d35-9255-faf36a8d63f5","resolution":{"observed_at":"2026-08-01T01:13:36.771985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.20526/citation-record","integrity":"/paper/2410.20526/integrity","json":"/paper/2410.20526/citation-record.json","paper":"/paper/2410.20526"},"outbound":[],"paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2410.20526."}