{"as_of":"2026-08-10T09:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c40484264568bc75c1c043225921d9bb34948e30f1b7dd4363ba0d6d2e4a174","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:30:22.804927Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.15038/citation-record","integrity":"/paper/2505.15038/integrity","json":"/paper/2505.15038/citation-record.json","paper":"/paper/2505.15038"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-07T15:30:20.574425Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.574425Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:5981db6d4f5720a2709e9ec921613605514f9ffad1348069b8e89cbe67205a49","observation_id":"c4a512aa-97f5-420f-847b-66e00b28f24a","resolution":{"observed_at":"2026-08-07T15:30:20.574425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:20.624619Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.624619Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:bb1cd17b6eb2db52e789792ad1305bfc1982144303d26629f28b26d6d36dfbd5","observation_id":"4b98db61-803d-43f1-a45c-ce8a3ff174e7","resolution":{"observed_at":"2026-08-07T15:30:20.624619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:20.661697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.661697Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:03cd19cc527f59e772949e0f99adf9f2f35353b80b442aec814553eeb693bce0","observation_id":"f767a57a-6f27-4a8c-ad8d-774bb4ee4c83","resolution":{"observed_at":"2026-08-07T15:30:20.661697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:24.033427Z","title":null,"venue":null,"work_id":"7b9e29e5-9e64-47e9-80ac-ff08716fb3e0","year":2022},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.730483Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:5b45e02d76726fbad3ca33912bb1702e9d62ea40714c25dfc0ff75667ce21ecf","observation_id":"9c8e84e3-b568-4947-9b8a-9ba528f8ad9b","resolution":{"observed_at":"2026-08-07T15:30:24.105150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-07T15:30:20.805089Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.805089Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:86672ee2b55e08f5afdd1de00c0badee8ba1d10f0011a46f9dd29059079749d4","observation_id":"acf4663b-dc61-4218-9511-4a37b9e26459","resolution":{"observed_at":"2026-08-07T15:30:20.805089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-07T15:30:20.901633Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.901633Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:ccf20f6fb055efb0183e29b2c890e6e48eb9fbd448cc1e55945a16c8944e0094","observation_id":"c04119bf-2f90-4b9f-8b3f-e5df7b6030ed","resolution":{"observed_at":"2026-08-07T15:30:20.901633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-05T02:09:50.000836Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-07T15:30:20.974878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:20.974878Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:6eba4200a34387575094a142ce4d745ba8b71ae7b295f6fd4e8001418446416e","observation_id":"94e961d9-3a53-49b2-8fec-3af767e6ca5e","resolution":{"observed_at":"2026-08-07T15:30:20.974878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11356","last_updated":"2025-02-17T02:11:17Z","snapshot_observed_at":"2026-08-07T18:14:00.096269Z","submitted_at":"2025-02-17T02:11:17Z","title":"SAIF: A Sparse Autoencoder Framework for Interpreting and Steering Instruction Following of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11356","snapshot_observed_at":"2026-08-07T15:30:21.080448Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.080448Z"},"links":{"cited_paper":"/paper/2502.11356","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:a4154afb8b73f25c250665f3eb046526dc3bb303e360038e4464951d5df9f001","observation_id":"d424c4f7-32fd-4dcd-9201-c843b9405c1e","resolution":{"observed_at":"2026-08-07T15:30:21.080448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03813","last_updated":"2023-12-06T18:27:07Z","snapshot_observed_at":"2026-08-08T09:14:49.430132Z","submitted_at":"2023-12-06T18:27:07Z","title":"Improving Activation Steering in Language Models with Mean-Centring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03813","snapshot_observed_at":"2026-08-07T15:30:21.140538Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.140538Z"},"links":{"cited_paper":"/paper/2312.03813","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:d5d12cff389622a5825378e0775028fd9342e239587c0e86d74cae322e0b324c","observation_id":"2e96da92-1044-4c69-b58c-6500163e9fcd","resolution":{"observed_at":"2026-08-07T15:30:21.140538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:23.888023Z","title":null,"venue":null,"work_id":"9b093c1a-334b-46ce-b33c-39cf8c0b8971","year":2018},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.185427Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:6035eb316214a22c06a693e348739567e67d9c41a693a62890fec5cc6f6af599","observation_id":"cd22533b-9f6c-49ed-b795-351f9708191c","resolution":{"observed_at":"2026-08-07T15:30:23.972516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01618","last_updated":"2024-02-02T18:31:15Z","snapshot_observed_at":"2026-08-06T11:52:35.328557Z","submitted_at":"2024-02-02T18:31:15Z","title":"Style Vectors for Steering Generative Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01618","snapshot_observed_at":"2026-08-07T15:30:21.230674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.230674Z"},"links":{"cited_paper":"/paper/2402.01618","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:0d39d57d4e660304890e10dda74dfec9cb8b8a3086bf899b2c5cabc5ff6acda2","observation_id":"abe22b27-7cb0-4906-9c8a-b4bb8757cb0f","resolution":{"observed_at":"2026-08-07T15:30:21.230674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:21.276165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.276165Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:d8421e852797e70f2516daa65dac38eb492d100a94736c7e3079b07bc856d771","observation_id":"c715f19e-34da-45d1-9d25-d3b0fab4ab85","resolution":{"observed_at":"2026-08-07T15:30:21.276165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-07T15:30:21.356728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.356728Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:8847f803269aabc890dc7f4fb70db3aabf9deacff6cf5b951a393a89b0cdf4ea","observation_id":"201a46ff-68fa-4b96-95bd-71bb9cfebe6b","resolution":{"observed_at":"2026-08-07T15:30:21.356728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:23.715089Z","title":null,"venue":null,"work_id":"cde96079-8dce-45c4-b96b-f5acca442a61","year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.439684Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:03924f0f9cce33d8d83d75d3bb4bbd46bcd0030a9716cca2ed41e2353d1b4ceb","observation_id":"fcc47d5e-3a73-4988-8fc7-f3ca0ca8939a","resolution":{"observed_at":"2026-08-07T15:30:23.793886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T15:30:21.522969Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.522969Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:455f0a972c10d63fcdb08f950499f12a06724082f70890d1620fe15a9deb99a9","observation_id":"e6aee399-47a2-4221-90da-cf60498f4283","resolution":{"observed_at":"2026-08-07T15:30:21.522969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-07T15:30:21.599322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.599322Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:85977c87b38a2abca3f3a16d66cea3169eb41757b743536df18e54e2d212dcbb","observation_id":"d9277a90-7d53-45b4-a424-402393b8b4df","resolution":{"observed_at":"2026-08-07T15:30:21.599322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:23.555875Z","title":null,"venue":null,"work_id":"b69eaecd-e309-4e74-9af9-04ad677eab08","year":2021},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.686367Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:1cf5926763d9d52412fa7de2ce8ab3e2b0b8bc74fe15679ca30485532aed7e47","observation_id":"3424a7f0-ba9a-476c-ada1-b166908d5378","resolution":{"observed_at":"2026-08-07T15:30:23.660873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T15:30:21.739066Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.739066Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:f095b3ee034e66ea7ea3cb9698273029d4be6c8c40800174e86521c7bbfa6154","observation_id":"4820c29c-ea39-43c9-9093-cab79cc64f85","resolution":{"observed_at":"2026-08-07T15:30:21.739066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-07T15:30:21.825428Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.825428Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:fc8122ab3e664ad70bb42c7fe5e891aa5877239a39ee228f0176f40d1cb5d555","observation_id":"b71ef92c-986b-492d-bf4c-c50c5a7a7587","resolution":{"observed_at":"2026-08-07T15:30:21.825428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.08080","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:23.104660Z","title":null,"venue":null,"work_id":"00b02dcd-aead-4732-8c22-90057a0ad075","year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.916267Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:f0299f94b2760513c35369e5c5f8df0bedc8fdfe3e84c5d4206afd9b64a36f30","observation_id":"87ed623a-6a64-4efb-94fa-1a8fbe0d7058","resolution":{"observed_at":"2026-08-07T15:30:23.177980Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:21.972928Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:21.972928Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:3fcf7cb39e0c9f24f22002697fa761f4ceb9bf8b34acd04b272de7aeebb9f888","observation_id":"d070b568-4c8d-4f55-a4d4-d1f5b0a05c2b","resolution":{"observed_at":"2026-08-07T15:30:21.972928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12877","last_updated":"2025-04-14T09:04:45Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-15T08:38:20Z","title":"Improving Instruction-Following in Language Models through Activation Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12877","snapshot_observed_at":"2026-08-07T15:30:22.087008Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.087008Z"},"links":{"cited_paper":"/paper/2410.12877","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:e93ffd2d19ed4ca2e6533435072be3581539d88dd6c4b1fb36749c1da9550cd1","observation_id":"07e0aa73-af02-4598-9da3-79196be7edc4","resolution":{"observed_at":"2026-08-07T15:30:22.087008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:22.166542Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.166542Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:bc4add41140883013a98bb5a5e78cfee389ea6ccfc7d8405417024fe8e37cb4d","observation_id":"7de8091e-ac4c-4508-b0d3-378160996a71","resolution":{"observed_at":"2026-08-07T15:30:22.166542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-10T04:41:46.240047Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T15:30:22.282961Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.282961Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:9b3918143d1f585552c60d05ee55857f84a488980038e23b2fc6f44369092ae1","observation_id":"7a9fc4e6-95b4-4fb6-a4ba-502bb7e25f20","resolution":{"observed_at":"2026-08-07T15:30:22.282961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14026","last_updated":"2025-03-20T20:41:32Z","snapshot_observed_at":"2026-08-07T21:28:18.831562Z","submitted_at":"2024-09-21T05:58:07Z","title":"Uncovering Latent Chain of Thought Vectors in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14026","snapshot_observed_at":"2026-08-07T15:30:22.389509Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.389509Z"},"links":{"cited_paper":"/paper/2409.14026","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:e3eb5929b13e9290fae6b44f52af88b0916c9258b6331a1afa2af3cf30a5890c","observation_id":"02064c76-1602-444d-b873-008b358aec07","resolution":{"observed_at":"2026-08-07T15:30:22.389509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:23.445683Z","title":null,"venue":null,"work_id":"4f08a146-70ea-42e1-b2ec-c2d1bdd5ef84","year":2025},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.506718Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:f746fe48a1b43c2bd54eb2b49a31880225220ead1daff9ad4be2240515ff8202","observation_id":"37472da4-fdd5-45de-8e4e-444bc9b51b85","resolution":{"observed_at":"2026-08-07T15:30:23.501130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T15:30:22.604271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.604271Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:836a7a8986f9e5de74c63dadf389d05e2db1dffdd4fc890dfbd4afeaa13324f9","observation_id":"82d1651b-11e6-416f-b5e6-6ca25a3eb113","resolution":{"observed_at":"2026-08-07T15:30:22.604271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:22.721748Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.721748Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:5c4d587c85c6ff5d2b83cfbf8a2cc63d84a40f8ec2ece45f44a2e3168d0a55f9","observation_id":"3fe23466-4c05-46bd-9a57-9b325f8c6c3b","resolution":{"observed_at":"2026-08-07T15:30:22.721748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:22.804927Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:30:22.804927Z"},"links":{"citing_paper":"/paper/2505.15038"},"observation_digest":"sha256:68d0291c47ee08dbbc38e12385a07ba54e9c668278c583e8ae0127351c57d66f","observation_id":"c374dd58-71b9-4f75-8c3f-01ec59ca538e","resolution":{"observed_at":"2026-08-07T15:30:22.804927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.15038","last_updated":"2025-07-29T21:40:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T23:07:55.774109Z","submitted_at":"2025-05-21T02:45:11Z","title":"Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2505.15038."}