{"as_of":"2026-08-17T17:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17cb3509b529368f01bfcfd6206bc53ba3410923638416aec168431f1e179d0b","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:21:34.095808Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T10:40:01.662137Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":"2504.20938","doi":"10.48550/arxiv.2504.20938","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":"ArXiv.org","work_id":"b806f79c-42b6-4248-ae90-463798e1af34","year":2025},"citing_paper":{"arxiv_id":"2604.11297","last_updated":"2026-04-13T10:59:28Z","snapshot_observed_at":"2026-08-13T09:13:17.587485Z","submitted_at":"2026-04-13T10:59:28Z","title":"The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:31.715954Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2604.11297"},"observation_digest":"sha256:878d7cf9a7af46d263a82643127d34c55d79cbc9384055dae71d520d5c7bcdf1","observation_id":"c39b9499-16e6-4950-b3df-ba9b0e5c3b20","resolution":{"observed_at":"2026-05-10T15:35:32.846244Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":"2504.20938","doi":"10.48550/arxiv.2504.20938","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":"ArXiv.org","work_id":"b806f79c-42b6-4248-ae90-463798e1af34","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:dff550af7ddde43d98fecada9dc3efd9c85807d1c5205afffc8fa7a148f1c054","observation_id":"b5ce9711-390c-4319-9681-f6ab24dbc286","resolution":{"observed_at":"2026-05-14T20:59:28.658104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":"2504.20938","doi":"10.48550/arxiv.2504.20938","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":"ArXiv.org","work_id":"b806f79c-42b6-4248-ae90-463798e1af34","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:bf3e7c6f92324add12266347f0f673cd562c77e67e691682d23e4d2e989d0e75","observation_id":"4d84dd86-ebbf-4ee0-b0c9-3a182183b521","resolution":{"observed_at":"2026-05-15T04:59:45.258995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":"2504.20938","doi":"10.48550/arxiv.2504.20938","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":"ArXiv.org","work_id":"b806f79c-42b6-4248-ae90-463798e1af34","year":2025},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:9785800db74e53fb78ace6292ca9036e8c38d5fc6c629182ca9ffadcce52754a","observation_id":"328a9f07-b921-4320-8a41-b73b6a33b28c","resolution":{"observed_at":"2026-06-28T23:32:46.682964Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-02T10:39:48.151675Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:48.151675Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:c65a8d365e4f8e247d8b9a4eda75815c7057f1bb685585495df53008deb9be31","observation_id":"d0531adb-c723-4a4c-aa41-e2b524fd2c5b","resolution":{"observed_at":"2026-08-02T10:39:48.151675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20938","snapshot_observed_at":"2026-08-02T10:40:01.662137Z","title":"Towards Understanding the Nature of Attention with Low - Rank Sparse Decomposition , April 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":160,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:01.662137Z"},"links":{"cited_paper":"/paper/2504.20938","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:88cd4d5b3ae637de6c4a81aa25d494d47c35c697c80608588d38e0db66d5e74a","observation_id":"e9b28670-8a8f-4615-a2f0-4485e8e3997d","resolution":{"observed_at":"2026-08-02T10:40:01.662137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20938/citation-record","integrity":"/paper/2504.20938/integrity","json":"/paper/2504.20938/citation-record.json","paper":"/paper/2504.20938"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03334","last_updated":"2024-10-04T11:40:21Z","snapshot_observed_at":"2026-08-16T13:12:37.754731Z","submitted_at":"2024-10-04T11:40:21Z","title":"An X-Ray Is Worth 15 Features: Sparse Autoencoders for Interpretable Radiology Report Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03334","snapshot_observed_at":"2026-08-16T05:21:33.854161Z","title":"Hyland, Daniel C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.854161Z"},"links":{"cited_paper":"/paper/2410.03334","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:8c04121822c9065718db1ec37be4973bdadfd9ef5056f7547406f28c9e447b57","observation_id":"841b2460-9333-4104-bae8-db0db3b94347","resolution":{"observed_at":"2026-08-16T05:21:33.854161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.859560Z","title":"GQA: training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.859560Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:4d77db85d0c83e9476a02b2f4c82afbfddc323380fcf9f520ec4ba3eb5c7b6ec","observation_id":"ceae6dea-c0d5-4251-a414-04ee162b4c3d","resolution":{"observed_at":"2026-08-16T05:21:33.859560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.765571Z","title":"Investigating successor heads","venue":null,"work_id":"1319039d-290a-4542-a0a3-98a70eb1e5ce","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.864209Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:2445df1011e0024245b7dcd292be3e5ec8d5984661babfcb78d06dea90aad7f6","observation_id":"df625bae-2760-4f66-8a81-9a207731c4b6","resolution":{"observed_at":"2026-08-16T05:21:34.769922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.869155Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.869155Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:4ed9331cfa2cb9ea28f5cdb0f1f85c9cad0dbf425cad1362362d2af1505b602d","observation_id":"9b3906e0-73a7-4a95-a1a5-bca9a937d9ed","resolution":{"observed_at":"2026-08-16T05:21:33.869155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.873953Z","title":"Linear algebraic structure of word senses, with applications to polysemy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.873953Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:9f1286815b69540c127dfb12bdace07281aa07237658b6b98a18f38d1f171505","observation_id":"203a3c23-04fc-456c-b8b8-4930711d7017","resolution":{"observed_at":"2026-08-16T05:21:33.873953Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.742537Z","title":"Circuits updates - march 2024","venue":null,"work_id":"4b2a94e3-192f-4023-a807-76b4d2f121ef","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.878910Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:d172b920f32bfcad46913d9e1c30a6ef7d662055d339433b8454b56465f158ae","observation_id":"81df82d4-9c4e-4d37-a38f-835d1e0ca6b7","resolution":{"observed_at":"2026-08-16T05:21:34.747690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.883448Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.883448Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:4854ea613083bf5e9949759462d8d7b406e20cd702c4b0b42f5fa1ef83556e34","observation_id":"54b5c374-4026-4ff3-ba22-37e2805962d9","resolution":{"observed_at":"2026-08-16T05:21:33.883448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.888631Z","title":"Language models can explain neurons in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.888631Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:64872c385d93040b664c45faa2f9098926aad1a9ffebcadb34f03e371cbec4e8","observation_id":"cea670da-0da0-40e5-9a47-e225d88ec91e","resolution":{"observed_at":"2026-08-16T05:21:33.888631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.893071Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.893071Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:fbe3094b74e3feb1f286f928ef8a30cdf46f23be6e0d51a9aac1e611130cdd04","observation_id":"c046db1a-c4f2-429a-b961-8591ed0d48e0","resolution":{"observed_at":"2026-08-16T05:21:33.893071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.702146Z","title":"Learning multi-level features with matryoshka saes","venue":null,"work_id":"7049457d-4a08-4bd3-bbc1-d2786f503573","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.897440Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:3213238b939b77d7fa3c70648bc9e9a47b7f123326c8a188f6fc27429e061650","observation_id":"3e5a0caf-c503-46dc-84cb-59fb8b7be571","resolution":{"observed_at":"2026-08-16T05:21:34.706877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.688514Z","title":"Circuits updates - february 2024","venue":null,"work_id":"cd73b5b7-b7dd-4379-b496-cdf66a1c60f3","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.902499Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:8293352ad54af73b0de2bee53f3b818597e1c053f8167a8152fb9adf1538a6c9","observation_id":"1dc1d14a-2357-4533-93e5-d22d75f7fd20","resolution":{"observed_at":"2026-08-16T05:21:34.692899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.674733Z","title":"Circuits updates - april 2024","venue":null,"work_id":"21ecb058-0ac7-4a36-9777-6c094d0a48ca","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.907898Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:c98348bebfe2c36bf57b25101f2d51b4ceba4df30bed42666d7ee90ff9d473c1","observation_id":"6eb2bb85-6b4b-4f0a-b88b-affe2090c58d","resolution":{"observed_at":"2026-08-16T05:21:34.678910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.660037Z","title":"Mavor - Parker, Aengus Lynch, Stefan Heimersheim, and Adri \\` a Garriga - Alonso","venue":null,"work_id":"ba49b705-9ddb-4287-859a-af8c6c729107","year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.912701Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:6c2449a16a6c15417807e8cdb48e939d0f472ccc03dc6ed4e5bb26ffbdcfa837","observation_id":"ae1b040f-4853-49ed-819a-e31cf022f2b3","resolution":{"observed_at":"2026-08-16T05:21:34.664772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-16T05:21:33.917333Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.917333Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:f14d0825e6d7cbd5429e6a5e96125be9631e648cd923b7fb35f0394f38e66cbf","observation_id":"91d223b7-b1ee-4258-99fd-e118d10e9ef1","resolution":{"observed_at":"2026-08-16T05:21:33.917333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T05:21:33.922838Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.922838Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:55f9f7db00afd427efe27de125fa625d3689297e985f2970a2438b77d8e8e597","observation_id":"ec24089e-a856-4782-9c6c-fce04bad0948","resolution":{"observed_at":"2026-08-16T05:21:33.922838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-16T13:42:08.334213Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-16T05:21:33.927686Z","title":"Transcoders find interpretable LLM feature circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.927686Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:1390f852852de5bc2fcba703fa5b8a61761818aa025ca3d052bf6288980b3ec6","observation_id":"a5bf3096-13ae-4fc6-b63d-faf210e7058f","resolution":{"observed_at":"2026-08-16T05:21:33.927686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:33.932861Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.932861Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:498d579aea7ad1b0e3f87eeb007cc5b87f7304ca4d83a62af3066206aa498f0f","observation_id":"fc86a35e-f928-417a-a7c5-5ec4e77a78ca","resolution":{"observed_at":"2026-08-16T05:21:33.932861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.636758Z","title":"Toy models of superposition","venue":null,"work_id":"1c480cc3-d544-4897-9cf0-cb1aee81c2cb","year":2022},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.937511Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:1563f64566d52f53f1c6494d75435c2e00135998027375967931d6c9e004ace3","observation_id":"ebaf0d76-001b-4397-bda0-f42e89141370","resolution":{"observed_at":"2026-08-16T05:21:34.641060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.622737Z","title":"Privileged bases in the transformer residual stream","venue":null,"work_id":"1427beb3-06a4-4605-9eae-1baeb900c332","year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.942008Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:8f287177c10ca901b776eac30ccc594ba303ea32a4815e5437402351265f2be2","observation_id":"e16a0c9f-c04d-4537-902d-0ce1ef1cc6e7","resolution":{"observed_at":"2026-08-16T05:21:34.627598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14670","last_updated":"2025-03-25T17:00:02Z","snapshot_observed_at":"2026-08-16T13:07:56.598647Z","submitted_at":"2024-10-18T17:58:53Z","title":"Decomposing The Dark Matter of Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14670","snapshot_observed_at":"2026-08-16T05:21:33.946749Z","title":"Decomposing the dark matter of sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.946749Z"},"links":{"cited_paper":"/paper/2410.14670","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:6b64dda4db9b205ccd3c57f67dec865b2327a3a44d0f10d608777b3070f3cdf4","observation_id":"d9265d54-85bc-4c3f-a5d8-568997fd9610","resolution":{"observed_at":"2026-08-16T05:21:33.946749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-16T05:21:33.951798Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.951798Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:e8c708d15365c1fb50d653f4d01e6d309e72b0fe966030f68477e04220af5fec","observation_id":"ff1f572f-93e7-43a3-9510-45cec4ace6bd","resolution":{"observed_at":"2026-08-16T05:21:33.951798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13868","last_updated":"2024-07-21T11:42:32Z","snapshot_observed_at":"2026-08-16T13:50:31.547274Z","submitted_at":"2024-05-22T17:50:04Z","title":"Automatically Identifying Local and Global Circuits with Linear Computation Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13868","snapshot_observed_at":"2026-08-16T05:21:33.956907Z","title":"Automatically identifying local and global circuits with linear computation graphs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.956907Z"},"links":{"cited_paper":"/paper/2405.13868","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:7811c7536289efab8028a190b7f469edbf3832ef237c22ac515a0c44979c780f","observation_id":"d6cf6feb-bd66-40f0-a75d-681ee4e6d83e","resolution":{"observed_at":"2026-08-16T05:21:33.956907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.606593Z","title":"Successor heads: Recurring, interpretable attention heads in the wild","venue":null,"work_id":"9938f336-c1d2-480e-9be0-0efa3e6b8b2b","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.961753Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:0713b2a7149def509f976565eeed3603403250970a3b948beadb5eab4d8ae9bf","observation_id":"a58857c1-5ada-4196-8028-fde66498b802","resolution":{"observed_at":"2026-08-16T05:21:34.612730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.591592Z","title":"Finding neurons in a haystack: Case studies with sparse probing","venue":null,"work_id":"7674054d-d1d1-4854-bf97-e5ecfdbbacd7","year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.966059Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:2ca01e9eb6df2bcb521503f2776976f4604d5059132b5bb5a7eccf2e10fc9211","observation_id":"0ab48272-ce68-4d3b-a8b8-b70b03f3d1db","resolution":{"observed_at":"2026-08-16T05:21:34.596174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.577584Z","title":"How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model","venue":null,"work_id":"2f09fa90-21a5-46b0-b85e-6dc98fc43d17","year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.970624Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:87f917537353d82c8b7f47ca79916b29acd708880d271a1b5f30dbde1b581372","observation_id":"bd92c09d-e49c-4120-a465-a4e346d61189","resolution":{"observed_at":"2026-08-16T05:21:34.582097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12201","last_updated":"2024-02-19T15:04:53Z","snapshot_observed_at":"2026-08-16T14:17:18.808026Z","submitted_at":"2024-02-19T15:04:53Z","title":"Dictionary Learning Improves Patch-Free Circuit Discovery in Mechanistic Interpretability: A Case Study on Othello-GPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12201","snapshot_observed_at":"2026-08-16T05:21:33.974837Z","title":"Dictionary learning improves patch-free circuit discovery in mechanistic interpretability: A case study on othello-gpt","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.974837Z"},"links":{"cited_paper":"/paper/2402.12201","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:aeb3274e15bf0cc12bdad18c5d4ec54d540bb6e9fbca10acf39b30e2b445d5f7","observation_id":"818b2bf1-2217-4704-8910-06b8fca051c0","resolution":{"observed_at":"2026-08-16T05:21:33.974837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-16T13:05:36.754275Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-16T05:21:33.979344Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.979344Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:a0369e46d7370fd0aa70aa68e0b501528b3c554f5b811594b70771bc21bbb7bd","observation_id":"1859745b-79bc-462e-a3b7-664f1a81a826","resolution":{"observed_at":"2026-08-16T05:21:33.979344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.563884Z","title":"Circuits updates - january 2024","venue":null,"work_id":"2fb52ce3-7485-43fd-845d-893f549181c8","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.984871Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:824f7d05a047e46de8484d2e88de6116c97283c51ee10f429c8503a6cc0061ce","observation_id":"ba8cdf98-03f3-4ef8-97ed-0e872d23090f","resolution":{"observed_at":"2026-08-16T05:21:34.568332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17759","last_updated":"2024-06-25T17:43:13Z","snapshot_observed_at":"2026-08-16T13:39:40.522215Z","submitted_at":"2024-06-25T17:43:13Z","title":"Interpreting Attention Layer Outputs with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17759","snapshot_observed_at":"2026-08-16T05:21:33.990706Z","title":"Interpreting attention layer outputs with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.990706Z"},"links":{"cited_paper":"/paper/2406.17759","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:03309d0e3fb374e016de0fff0e305935009b4f51470a2c21aad4fee3ec4b752a","observation_id":"7f224a36-a82f-44e2-9f41-d3d1094094d8","resolution":{"observed_at":"2026-08-16T05:21:33.990706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.549696Z","title":"We inspected every head in gpt-2 small using saes so you don’t have to","venue":null,"work_id":"a3d33b67-a705-4e5b-82fe-e3c0bff58dc2","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:33.996065Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:5cdbf398f68bb9c77304e9f22bf3268c1101045deccc22ba24e1ab96230ca7e7","observation_id":"f3613b24-d840-4eb9-aaf2-c378690cef2d","resolution":{"observed_at":"2026-08-16T05:21:34.554227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-16T05:21:34.000670Z","title":"Dragan, Rohin Shah, and Neel Nanda","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.000670Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:e2f006cbedeb29ee59346e36579ecca9ffe7d294e2b24b2c0b4cfdd0354d616c","observation_id":"577fe07b-c46c-48ea-a8ea-f9494129aaaf","resolution":{"observed_at":"2026-08-16T05:21:34.000670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.534914Z","title":"Sparse crosscoders for cross-layer features and model diffing","venue":null,"work_id":"53fa20e8-a475-4b88-a1e6-95ec6b7a8d91","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.005437Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:e4dd98fda4ff310d3836151b43d8cb0014b648b3a31c377c4ae1ad5727136289","observation_id":"1aa8995e-6ccb-4ff6-b9e7-ab4964fc8759","resolution":{"observed_at":"2026-08-16T05:21:34.539644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.010473Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.010473Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:d7791c27c14084d5e383af9bbb08668c93ce672c0dfe4c3a325d8710cdbd87d7","observation_id":"a8c42e8e-1bde-46a3-b6c7-2b9908ec22f2","resolution":{"observed_at":"2026-08-16T05:21:34.010473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04625","last_updated":"2023-10-06T23:37:24Z","snapshot_observed_at":"2026-08-16T14:54:19.799018Z","submitted_at":"2023-10-06T23:37:24Z","title":"Copy Suppression: Comprehensively Understanding an Attention Head","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04625","snapshot_observed_at":"2026-08-16T05:21:34.015126Z","title":"Copy suppression: Comprehensively understanding an attention head","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.015126Z"},"links":{"cited_paper":"/paper/2310.04625","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:f2674817753aa5e96c9e2a3b7c477adc1fe974b5f6b79b67a01ee1cdfebb7fac","observation_id":"b85343e4-9dc7-4f1d-8b7e-606bd1ed413d","resolution":{"observed_at":"2026-08-16T05:21:34.015126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.019977Z","title":"Locating and editing factual associations in GPT","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.019977Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:1f112f888601001568eee7837cace39de019123d1b3d03757029d5068727d8c6","observation_id":"97b2d602-dc0f-4d0b-995e-5da403c2a3b4","resolution":{"observed_at":"2026-08-16T05:21:34.019977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21272","last_updated":"2025-05-20T16:29:40Z","snapshot_observed_at":"2026-08-16T13:05:16.958093Z","submitted_at":"2024-10-28T17:59:06Z","title":"Arithmetic Without Algorithms: Language Models Solve Math With a Bag of Heuristics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21272","snapshot_observed_at":"2026-08-16T05:21:34.024650Z","title":"Arithmetic without algorithms: Language models solve math with a bag of heuristics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.024650Z"},"links":{"cited_paper":"/paper/2410.21272","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:a8ca8552a32466a98ebe490377140197034840bad0e33efccbb73ddd1c0c43c1","observation_id":"d997c440-e44b-4baf-a679-a3adc47c2fce","resolution":{"observed_at":"2026-08-16T05:21:34.024650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.502706Z","title":"interpreting gpt: the logit lens","venue":null,"work_id":"9033c16d-8c04-404e-82c5-4ee26566df0d","year":2020},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.029209Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:f15cef82fe19dcbf6a8543d920acb15aeb29c651ff69afa7775878528dc0c473","observation_id":"af6c29e5-309f-40ac-9a61-3cb047bf91b2","resolution":{"observed_at":"2026-08-16T05:21:34.507329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.488454Z","title":"Circuits updates - july 2024","venue":null,"work_id":"926b1269-128e-42eb-bafb-23ef9ef10cdd","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.034720Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:166ab82b45f7a087534ebc1ffe8a07afba8812624521294c6e469c0289ef843d","observation_id":"98d853a8-1720-4094-842b-dc2fe2656133","resolution":{"observed_at":"2026-08-16T05:21:34.492898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.038983Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.038983Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:44bb779b188bf52dfa46588a5e700e834286baf9d74c3e83df265f0ced43e085","observation_id":"93f757ae-d6f1-4fc3-9727-99f21e847a42","resolution":{"observed_at":"2026-08-16T05:21:34.038983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.474173Z","title":"In-context learning and induction heads","venue":null,"work_id":"55e6d2fa-6b60-48a6-a7d6-66cd0e33c70d","year":2022},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.043226Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:955818efc75e4f00aeb1b7bcdf66afc45ef3d7a9101143da969081acb99d7870","observation_id":"00284d91-c70e-4c63-bf78-a999c48d104f","resolution":{"observed_at":"2026-08-16T05:21:34.478775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16014","last_updated":"2024-04-30T17:54:04Z","snapshot_observed_at":"2026-08-02T10:59:21.418230Z","submitted_at":"2024-04-24T17:47:22Z","title":"Improving Dictionary Learning with Gated Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16014","snapshot_observed_at":"2026-08-16T05:21:34.047569Z","title":"Improving dictionary learning with gated sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.047569Z"},"links":{"cited_paper":"/paper/2404.16014","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:d7609b3362a4635c8a77211b4f412fb86148fad7bd117aac7e9aee71ac81a8f1","observation_id":"b248592b-186f-4cab-9fb0-9aa1d116428f","resolution":{"observed_at":"2026-08-16T05:21:34.047569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.052412Z","title":"SlimPajama: A 627B token cleaned and deduplicated version of RedPajama","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.052412Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:e165192ca5121bfcc580015fa362f3c8d41da5a0d293e8e9a304e297e3f82bb1","observation_id":"79db3ea2-c12f-4cd1-a85b-fd8073caaf59","resolution":{"observed_at":"2026-08-16T05:21:34.052412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-16T05:21:34.056864Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.056864Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:157a5c4c110cf7f4a5793d941b29bab1128a6c839c5e4a50421e85faa8006070","observation_id":"271d5937-0142-44a2-8d91-b17868e71768","resolution":{"observed_at":"2026-08-16T05:21:34.056864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.450183Z","title":"Circuits updates - january 2024","venue":null,"work_id":"27282cae-265f-4df7-b2c1-3d52c9a19166","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.064399Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:a45f196dc3f8a84900a679098a8f5abcb7328c041213954e20c40b54e75f1ceb","observation_id":"9b1f6174-bb1e-4d50-9305-1de5845481cc","resolution":{"observed_at":"2026-08-16T05:21:34.454542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.435697Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":"b6135567-6a7d-4633-ae7b-cb3dc8f946cb","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.069289Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:9e3b546ca95493a4cac0ff32bbb4747b2f2ed03801ffcb9a0562c8f1615682bc","observation_id":"1e307001-eaf0-49bd-a53e-be0e8e2240ff","resolution":{"observed_at":"2026-08-16T05:21:34.440784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06672","last_updated":"2024-10-10T16:51:42Z","snapshot_observed_at":"2026-08-16T23:33:47.709481Z","submitted_at":"2024-10-09T08:28:53Z","title":"Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06672","snapshot_observed_at":"2026-08-16T05:21:34.073745Z","title":"Towards universality: Studying mechanistic similarity across language model architectures","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.073745Z"},"links":{"cited_paper":"/paper/2410.06672","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:ef29d2870e811815abc46f933aa04c111543fd7bcae028bdaad4ca1dfb2958da","observation_id":"529f19ca-c0c0-4510-ab3e-8d572bbe242d","resolution":{"observed_at":"2026-08-16T05:21:34.073745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.078512Z","title":"Interpretability in the wild: a circuit for indirect object identification in GPT-2 small","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.078512Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:c5e3502a5f900b8cf6e2ec7feb9aa10c7873c57f759c0ed834ac5dd6f2d02b11","observation_id":"0c8aa047-1c47-4bb0-9e99-39589cd655a7","resolution":{"observed_at":"2026-08-16T05:21:34.078512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.411923Z","title":"Addressing feature suppression in saes","venue":null,"work_id":"a509b6ce-b6aa-4114-8417-bafb24299b27","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.082779Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:33f6d02151c7e9ad8c68dd1dd1f0c46b772de1157a630bd225338a70f45c828d","observation_id":"24d7cee7-9a87-435d-b255-491aeacf4fb5","resolution":{"observed_at":"2026-08-16T05:21:34.416558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15574","last_updated":"2024-04-24T00:24:03Z","snapshot_observed_at":"2026-08-16T13:58:20.510591Z","submitted_at":"2024-04-24T00:24:03Z","title":"Retrieval Head Mechanistically Explains Long-Context Factuality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15574","snapshot_observed_at":"2026-08-16T05:21:34.087163Z","title":"Retrieval head mechanistically explains long-context factuality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.087163Z"},"links":{"cited_paper":"/paper/2404.15574","citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:84532bc9e6893ba49655ca7280f59c05da2b80ede71ac8b597d05662581755bd","observation_id":"68f4bc23-0f97-4463-b84a-2221f2d7af7c","resolution":{"observed_at":"2026-08-16T05:21:34.087163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.091712Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.091712Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:466c0742ab36d1f02a8fa9c1295b14984ac6b2e47b0797c3c8f11ba85b101486","observation_id":"209b7b98-1cc0-43a8-b31c-47ba5881e880","resolution":{"observed_at":"2026-08-16T05:21:34.091712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:21:34.386830Z","title":"Towards best practices of activation patching in language models: Metrics and methods","venue":null,"work_id":"98a72421-2885-4eba-b956-3ad3938c81aa","year":2024},"citing_paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T05:21:34.095808Z"},"links":{"citing_paper":"/paper/2504.20938"},"observation_digest":"sha256:a5700b7b9d915c33ea2e0c2d0673ae42a313719b0dd56467bb0e67637b304581","observation_id":"3b9c9586-66af-459f-aa6d-ef156412683a","resolution":{"observed_at":"2026-08-16T05:21:34.392843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.20938","last_updated":"2025-04-29T17:03:03Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T06:20:39.953398Z","submitted_at":"2025-04-29T17:03:03Z","title":"Towards Understanding the Nature of Attention with Low-Rank Sparse Decomposition"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 6 inbound Pith citation observations for arXiv:2504.20938."}