{"as_of":"2026-08-14T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f9febdf351eb108566b81875e4ea43609bb9402f22fef854e4162590b28227e","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:55:02.296395Z","state":"measured"},{"denominator":112,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":112,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:48:35.756321Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T13:45:45.794455Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-06T22:48:35.756321Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20790","last_updated":"2025-09-04T11:41:34Z","snapshot_observed_at":"2026-08-13T19:51:32.182781Z","submitted_at":"2025-06-25T19:26:31Z","title":"Stochastic Parameter Decomposition","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T22:48:35.756321Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2506.20790"},"observation_digest":"sha256:85084dc4ea6a19a519ac8f7a89928b8e7497dfb206ad21d8e8394afbc331cf58","observation_id":"949792ff-a09c-423b-af8d-70de132f16cb","resolution":{"observed_at":"2026-08-06T22:48:35.756321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-06T17:53:54.937410Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09816","last_updated":"2025-07-13T22:18:15Z","snapshot_observed_at":"2026-08-13T02:50:00.822082Z","submitted_at":"2025-07-13T22:18:15Z","title":"Compressed Computation: Dense Circuits in a Toy Model of the Universal-AND Problem","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:53:54.937410Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2507.09816"},"observation_digest":"sha256:1ed84b7e07193f326ee8b2dc88cb9e6cb69f78e2b0e7bf7b9bc98417727bbcbf","observation_id":"9ba45641-6e74-4ebd-b363-e38974e2b928","resolution":{"observed_at":"2026-08-06T17:53:54.937410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-05T14:27:25.414379Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21324","last_updated":"2025-08-29T04:42:17Z","snapshot_observed_at":"2026-08-09T09:00:42.140024Z","submitted_at":"2025-08-29T04:42:17Z","title":"Distribution-Aware Feature Selection for SAEs","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-05T14:27:25.414379Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2508.21324"},"observation_digest":"sha256:f4fe6c84cc5d0cd6e86b3e64fba566cfef0524269b170fb0834f0e62649c8b86","observation_id":"faf94b8e-5da5-4fb6-b848-1c0faa36b836","resolution":{"observed_at":"2026-08-05T14:27:25.414379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2509.06701","last_updated":"2026-05-12T03:07:08Z","snapshot_observed_at":"2026-08-13T16:15:19.884745Z","submitted_at":"2025-09-08T13:55:01Z","title":"Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T18:25:25.751119Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2509.06701"},"observation_digest":"sha256:ba74e2eb1ad48a32d16cfff509372930676bf4b30e71dff5a10d6c0699b77ebf","observation_id":"970d5072-366b-40f5-822d-c524a60c0c1e","resolution":{"observed_at":"2026-05-18T18:26:43.729817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-11T08:05:03.537052Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":1},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-05-12T02:42:26.173782Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:4202293dd6d74482689115b9a4fdd96100d81e3586b6ed69d8021f0da0207d59","observation_id":"97c1011c-aafe-420a-98b0-3c93a5cfaa63","resolution":{"observed_at":"2026-05-12T07:31:25.724304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-08-11T08:05:03.537052Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-30T22:50:30.931443Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:d22a67a20d92cc03ed16af8fc2c5596f5a61be7bce2d857942404553b308950a","observation_id":"d4ce204f-df02-4e4e-905c-993e9ec9ba84","resolution":{"observed_at":"2026-07-01T13:45:45.796059Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:929e6429561366d177efcc159e87b269dd83a21430d48d7ee8c75e17703fc9f5","observation_id":"0db6320c-f8c7-465e-814b-e2be99bfdfde","resolution":{"observed_at":"2026-05-14T20:59:28.694229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:fe5b2acd0f6760b984a59c891ae3f68059f955474c3a7fe8c07c89907443361f","observation_id":"301edd04-c892-43ea-9e67-1927f76d2a69","resolution":{"observed_at":"2026-05-15T04:59:45.129312Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:c275952a8511220fa1503631621691b9face2a0bd3cec799d64e39396d5325c7","observation_id":"1fdbf09e-296c-4b81-87df-b3ffdcc8d030","resolution":{"observed_at":"2026-05-20T21:53:47.229223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":"2501.14926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-01T13:45:45.794455Z","title":"2025 , archivePrefix=","venue":null,"work_id":"c636c722-428c-471d-b0d4-43ba45159958","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:400abf2992da1cdf5c0da77d6d90803c5c687623b7725dfb7a77cc96baa2ea37","observation_id":"7ef79c78-70c0-401c-bf1c-8af855b4db2d","resolution":{"observed_at":"2026-05-21T07:49:50.131311Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-12T05:48:11.148130Z","title":"Interpretability in parameter space: Minimizing mechanistic description length with attribution-based parameter decomposition.arXiv preprint arXiv:2501.14926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02964","last_updated":"2026-07-03T05:15:55Z","snapshot_observed_at":"2026-08-02T17:51:58.348369Z","submitted_at":"2026-07-03T05:15:55Z","title":"Individual Parameters in Weight-Sparse Transformers Appear Interpretable","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T05:48:11.148130Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.02964"},"observation_digest":"sha256:4914cb866f6ae798590d464cf056e423ea5cca198819bdee9be6e277f52d35dd","observation_id":"be8bee61-c3f9-4374-b900-fbd07da20073","resolution":{"observed_at":"2026-07-12T05:48:11.148130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-07-11T13:19:28.945702Z","title":"Bushnaq, L., Braun, D., and Sharkey, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04800","last_updated":"2026-07-06T08:33:51Z","snapshot_observed_at":"2026-08-12T23:48:32.333779Z","submitted_at":"2026-07-06T08:33:51Z","title":"Compressed Computation under $L^4$ Loss is likely Computation in Superposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T13:19:28.945702Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.04800"},"observation_digest":"sha256:c008491e2fbc762595dd751bb10baa3e0246fab827e64c5097ceec6884e3d8c9","observation_id":"d27582ca-8c0b-4f9a-b194-fd0664b6eb63","resolution":{"observed_at":"2026-07-11T13:19:28.945702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-02T10:39:49.368052Z","title":"Interpretability in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:49.368052Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:f7963330e9c22c2719b1f1f28d044b92bcb936eb4aa0c3451a6172767ae01015","observation_id":"8e665692-cb8f-4e65-a9a0-5204335db1d1","resolution":{"observed_at":"2026-08-02T10:39:49.368052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14926","snapshot_observed_at":"2026-08-02T10:40:00.727345Z","title":"Interpretability in Parameter Space : Minimizing Mechanistic Description Length with Attribution -based Parameter Decomposition , February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:00.727345Z"},"links":{"cited_paper":"/paper/2501.14926","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:e51da6dd939f16c3c95d3e6d45033da048096db2ef98956a5f03816506827893","observation_id":"1a523d31-c07d-4b39-8f31-8764ba993132","resolution":{"observed_at":"2026-08-02T10:40:00.727345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14926/citation-record","integrity":"/paper/2501.14926/integrity","json":"/paper/2501.14926/citation-record.json","paper":"/paper/2501.14926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.928897Z","title":"Kanwal, Tegan Maharaj, Asja Fischer, Aaron Courville, Yoshua Bengio, and Simon Lacoste-Julien","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.928897Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:20d7aa444012b89951ca2b27d1814c9f309c2793eff39ece08723cceafb8dab3","observation_id":"09b1940d-c108-4a28-8004-fa2c71e34720","resolution":{"observed_at":"2026-08-10T14:55:01.928897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11179","last_updated":"2024-10-15T01:38:03Z","snapshot_observed_at":"2026-08-13T17:06:34.178369Z","submitted_at":"2024-10-15T01:38:03Z","title":"Interpretability as Compression: Reconsidering SAE Explanations of Neural Activations with MDL-SAEs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11179","snapshot_observed_at":"2026-08-10T14:55:01.933680Z","title":"Pearce, and Lee Sharkey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.933680Z"},"links":{"cited_paper":"/paper/2410.11179","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9e8039ec7ca522574551cb3a3a2b5f979984fd30ebe95c1ae0a01e0f2fe1adf2","observation_id":"5ff0f2e1-5552-4681-9d87-e8bca6b4e05e","resolution":{"observed_at":"2026-08-10T14:55:01.933680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12241","last_updated":"2024-05-24T13:16:32Z","snapshot_observed_at":"2026-08-14T04:38:42.916801Z","submitted_at":"2024-05-17T17:03:46Z","title":"Identifying Functionally Important Features with End-to-End Sparse Dictionary Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12241","snapshot_observed_at":"2026-08-10T14:55:01.937875Z","title":"Identifying functionally important features with end-to-end sparse dictionary learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.937875Z"},"links":{"cited_paper":"/paper/2405.12241","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:4107c631a7a9613c41aae7c5c4a84cc23098bff3e5a0776097d3a8fac9010606","observation_id":"1343e9ed-b73c-47b6-9cb1-6bd36fea3079","resolution":{"observed_at":"2026-08-10T14:55:01.937875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.941999Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.941999Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5d40e61c6d6727896974efcf5a8cafc9fe9d1225937d5854654d2591c8c01c8a","observation_id":"617b012a-0737-4cfb-a035-3ad389d2c153","resolution":{"observed_at":"2026-08-10T14:55:01.941999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.945578Z","title":"Circuits in superposition: Compressing many small neural networks into one, Oct 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.945578Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e0aa226100b4347331843a0e1014fb8c9eeb9f567f7882df99dc93898941a05c","observation_id":"17a24b05-cdfe-45f0-a115-ef6429f162a1","resolution":{"observed_at":"2026-08-10T14:55:01.945578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.949426Z","title":"Showing sae latents are not atomic using meta-saes, Aug 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.949426Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f558589aceccf1598b9ed22dbf437a3142ec1e28bfd6318eb481219886fe8bea","observation_id":"193ed564-f8a4-4aad-a858-f59e4a85b671","resolution":{"observed_at":"2026-08-10T14:55:01.949426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06410","last_updated":"2024-12-09T11:39:00Z","snapshot_observed_at":"2026-08-11T19:38:54.071574Z","submitted_at":"2024-12-09T11:39:00Z","title":"BatchTopK Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06410","snapshot_observed_at":"2026-08-10T14:55:01.953347Z","title":"Batchtopk sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.953347Z"},"links":{"cited_paper":"/paper/2412.06410","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5d89275c0853363459a26c2bad8172238d59f934fcee1b6a323685e4befb0f5e","observation_id":"d30465e6-3b9d-4f7b-bb16-4213df4a7c54","resolution":{"observed_at":"2026-08-10T14:55:01.953347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.23915/distill.00024.003","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.360536Z","title":"Curve detectors","venue":null,"work_id":"cc9c91fb-0a24-476b-98c8-49e6b4e290f1","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.956984Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a6bb66284575a8369e81b95c7b6ce47bbfa3ebe9a978fc6c588c2fa6f9d49f0e","observation_id":"f9a57fa0-9dce-4478-bfd3-d50e6ce8a2f3","resolution":{"observed_at":"2026-08-10T14:55:02.364185Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06837","last_updated":"2021-12-13T17:49:16Z","snapshot_observed_at":"2026-08-13T17:16:49.377547Z","submitted_at":"2021-12-13T17:49:16Z","title":"Sparse Interventions in Language Models with Differentiable Masking","version":1},"cited_work":{"arxiv_id":"2112.06837","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.06837","snapshot_observed_at":"2026-08-10T14:55:03.047781Z","title":"Sparse Interventions in Language Models with Differentiable Masking","venue":"cs.CL","work_id":"11d64e7c-c225-465a-9d50-42fa240a1f93","year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.960536Z"},"links":{"cited_paper":"/paper/2112.06837","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2be1b244e06504bb4bccc8ab36db3d4972b4a8e8e40d19d80cf33fb70f41ee63","observation_id":"5a849cf2-d68c-421a-8e7a-34e97ad9fceb","resolution":{"observed_at":"2026-08-10T14:55:03.051866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03514","last_updated":"2021-04-08T05:11:21Z","snapshot_observed_at":"2026-08-14T06:55:48.953585Z","submitted_at":"2021-04-08T05:11:21Z","title":"Low-Complexity Probing via Finding Subnetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03514","snapshot_observed_at":"2026-08-10T14:55:01.964739Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.964739Z"},"links":{"cited_paper":"/paper/2104.03514","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5a99b17673195a2088cce435da73b8cc64fdf5ef1b8ac3d914952bcadb8b7fa0","observation_id":"6219a49f-4d1d-40ad-a3ae-772fa3017154","resolution":{"observed_at":"2026-08-10T14:55:01.964739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.968431Z","title":"Scaling sparse feature circuit finding to gemma 9b, Jan 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.968431Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:4a35189ffa134ca57272e8244cea027b26a60d1f1cde9555bcdd06016225b785","observation_id":"dc2834c1-68c5-4f5a-ac30-c087d3e5389c","resolution":{"observed_at":"2026-08-10T14:55:01.968431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.971790Z","title":"Causal scrubbing: a method for rigorously testing interpretability hypotheses [redwood research], December 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.971790Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:71726e65454df72b76a3a85a632e63431dc9ab57276237cd34bd642584dfa1a3","observation_id":"1f48ec39-8b39-4b38-a953-a1d9e47a4db5","resolution":{"observed_at":"2026-08-10T14:55:01.971790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.975190Z","title":"A is for absorption: Studying feature splitting and absorption in sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.975190Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1983f2b3ccc565da943b22df6c4a0c72c1f38dd595b262e8acf59b05493387ec","observation_id":"546cff5e-8947-47fd-934a-e30a42636ba2","resolution":{"observed_at":"2026-08-10T14:55:01.975190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.978532Z","title":"Mechanistic anomaly detection and elk, 11 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.978532Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:dbf82e186da5878d394c27393681e3e843213b52a54aeaf0f93e32e181472402","observation_id":"04522526-8efe-485b-a520-813d8c30e6cf","resolution":{"observed_at":"2026-08-10T14:55:01.978532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0095.2007","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.956600Z","title":"Churchland and Krishna V","venue":null,"work_id":"79322821-21f6-42a5-8458-db92eb9380bc","year":2007},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.981840Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:6d0414e4b45a783b6b4d86777c87701594835f0169e05fd56682af878d87f7d5","observation_id":"33eb7777-8d0c-402d-97e8-cc2dcb5d71a1","resolution":{"observed_at":"2026-08-10T14:55:02.961740Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.985118Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.985118Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2e152eaf68a647256f338b5bd1505e4e085d624c3a4b58983cf7a1cbd077fe07","observation_id":"9db26d29-d035-4ea8-beff-77c8a4529424","resolution":{"observed_at":"2026-08-10T14:55:01.985118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02066","last_updated":"2021-03-06T17:35:13Z","snapshot_observed_at":"2026-08-07T17:33:52.595773Z","submitted_at":"2020-10-05T15:04:11Z","title":"Are Neural Nets Modular? Inspecting Functional Modularity Through Differentiable Weight Masks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02066","snapshot_observed_at":"2026-08-10T14:55:01.988432Z","title":"Are neural nets modular? inspecting functional modularity through differentiable weight masks, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.988432Z"},"links":{"cited_paper":"/paper/2010.02066","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:040fb52cbfd0675874edd213fc07b52047746171d88d0ca30e9cc6f11857ace2","observation_id":"6b099cc3-2232-4000-819f-47c3cd3e1f91","resolution":{"observed_at":"2026-08-10T14:55:01.988432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-10T14:55:01.992243Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.992243Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d8105230a1a8ab911d6555f1b5229c2dc08aae870af1172691ea500cc9fbfd90","observation_id":"38b58961-102f-43bd-a77d-cbb852b1bd9d","resolution":{"observed_at":"2026-08-10T14:55:01.992243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02535","last_updated":"2023-12-24T23:11:19Z","snapshot_observed_at":"2026-08-13T15:51:26.424803Z","submitted_at":"2022-09-06T14:36:57Z","title":"Analyzing Transformers in Embedding Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02535","snapshot_observed_at":"2026-08-10T14:55:01.995894Z","title":"Analyzing transformers in embedding space, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.995894Z"},"links":{"cited_paper":"/paper/2209.02535","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2ddd38db3b1ff456fd8f12bc794d22e1d5a35db3084b3141cde8063161f67a22","observation_id":"a9b78691-305a-4fe5-8d84-79138553c88c","resolution":{"observed_at":"2026-08-10T14:55:01.995894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:01.999413Z","title":"Attention is not all you need: Pure attention loses rank doubly exponentially with depth, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:01.999413Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a22d4efdd08eeac3ef3005198eb090a42cd15233df5a432c4e34c80100eb6758","observation_id":"02b195aa-5c63-464e-a5f2-1017fd31ba0a","resolution":{"observed_at":"2026-08-10T14:55:01.999413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-12T23:40:48.506661Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-10T14:55:02.002736Z","title":"Transcoders find interpretable llm feature circuits, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.002736Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:06d0e65742523710848ac870700885e8a55b65c6f064efb010669d978f4a6cbd","observation_id":"857d6d2a-c940-435b-af91-f7e7e6bbd5e5","resolution":{"observed_at":"2026-08-10T14:55:02.002736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.006464Z","title":"Toy models of superposition, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.006464Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e52d39b9eeb5ea9a42bccdd651d010e92f3a7ce5de9adfac45e696947796acd7","observation_id":"880d3fbb-f6e2-47a6-ae83-63e9266f9aa4","resolution":{"observed_at":"2026-08-10T14:55:02.006464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-08-12T23:59:30.569903Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-10T14:55:02.009949Z","title":"Michaud, Wes Gurnee, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.009949Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b262c9bc2b7f4ba72f4df580d49601c31377e9de7c7f8602247b6ae5e028d861","observation_id":"5874e8a3-6850-4b3d-b82f-6b03d75d2222","resolution":{"observed_at":"2026-08-10T14:55:02.009949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14670","last_updated":"2025-03-25T17:00:02Z","snapshot_observed_at":"2026-08-12T22:19:51.988026Z","submitted_at":"2024-10-18T17:58:53Z","title":"Decomposing The Dark Matter of Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14670","snapshot_observed_at":"2026-08-10T14:55:02.013757Z","title":"Decomposing the dark matter of sparse autoencoders, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.013757Z"},"links":{"cited_paper":"/paper/2410.14670","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b48a73f3231b472ac5dc243e866fd1c61b95495fead8cede33a02a600c7ef991","observation_id":"012ba044-59ae-4167-98ad-600cc8c965b8","resolution":{"observed_at":"2026-08-10T14:55:02.013757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01667","last_updated":"2022-09-04T18:00:29Z","snapshot_observed_at":"2026-08-13T14:33:16.930303Z","submitted_at":"2022-09-04T18:00:29Z","title":"A Review of Sparse Expert Models in Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.01667","snapshot_observed_at":"2026-08-10T14:55:02.018437Z","title":"A review of sparse expert models in deep learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.018437Z"},"links":{"cited_paper":"/paper/2209.01667","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:02373114f652a38a872d0b1a709d6167c0bb7997b2a033c3ad818b84d2f30a05","observation_id":"6dff0965-55a0-415e-8a6d-9902d668811e","resolution":{"observed_at":"2026-08-10T14:55:02.018437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06087","last_updated":"2021-06-22T05:40:01Z","snapshot_observed_at":"2026-08-03T08:43:53.459112Z","submitted_at":"2021-06-10T23:50:51Z","title":"Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06087","snapshot_observed_at":"2026-08-10T14:55:02.022650Z","title":"Causal analysis of syntactic agreement mechanisms in neural language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.022650Z"},"links":{"cited_paper":"/paper/2106.06087","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9bf15ebdd1adc514dc9d20e3648d10ad025f5ac59950ced55acbe7ed5d59b852","observation_id":"fecae163-1a60-4bcd-9a43-0c868c0a2d76","resolution":{"observed_at":"2026-08-10T14:55:02.022650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-10T14:55:02.026867Z","title":"Scaling and evaluating sparse autoencoders, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.026867Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:8b9372f591ec28f3c9c2b25e85482223c53f24b51c6729e9c53d9b36ed7245d9","observation_id":"fe569175-70a4-4fd3-a0d0-eadd57c48af5","resolution":{"observed_at":"2026-08-10T14:55:02.026867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02536","last_updated":"2024-02-21T23:23:18Z","snapshot_observed_at":"2026-08-13T12:32:04.327199Z","submitted_at":"2023-03-05T00:57:49Z","title":"Finding Alignments Between Interpretable Causal Variables and Distributed Neural Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02536","snapshot_observed_at":"2026-08-10T14:55:02.030913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.030913Z"},"links":{"cited_paper":"/paper/2303.02536","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:40f784a373e012c37d562be2f7053e2f738137ce0226b9c42e1ca8feb40664db","observation_id":"024c1d07-87f5-4b2e-9bc5-4ecb81d25b8b","resolution":{"observed_at":"2026-08-10T14:55:02.030913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.13927","last_updated":"2020-10-26T22:13:59Z","snapshot_observed_at":"2026-08-13T17:22:58.851727Z","submitted_at":"2020-10-26T22:13:59Z","title":"A novel variational form of the Schatten-$p$ quasi-norm","version":1},"cited_work":{"arxiv_id":"2010.13927","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.13927","snapshot_observed_at":"2026-08-10T14:55:02.765725Z","title":"A novel variational form of the Schatten-$p$ quasi-norm","venue":"math.NA","work_id":"6eb30744-5425-4fde-b524-0c0a08dd069c","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.035166Z"},"links":{"cited_paper":"/paper/2010.13927","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:12cc5ce2edf1a7312e5aefe85ee92550bc5d64e12513a4a1a9e27f33b60d0a51","observation_id":"07062fd1-bf6e-49ed-897f-9cf7533316fa","resolution":{"observed_at":"2026-08-10T14:55:02.770315Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11779","last_updated":"2024-12-24T07:17:37Z","snapshot_observed_at":"2026-08-12T23:40:50.494267Z","submitted_at":"2024-06-17T17:34:25Z","title":"Compact Proofs of Model Performance via Mechanistic Interpretability","version":14},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11779","snapshot_observed_at":"2026-08-10T14:55:02.039261Z","title":"Compact proofs of model performance via mechanistic interpretability, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.039261Z"},"links":{"cited_paper":"/paper/2406.11779","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:0ea0b9ce832b433d4452eb6ceeff9d16746613a989c5f7fcbe6bc94d7bd8d768","observation_id":"62522e02-b85a-4cec-a10e-70bf871d2e0d","resolution":{"observed_at":"2026-08-10T14:55:02.039261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.043051Z","title":"Superposition, memorization, and double descent, Jan 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.043051Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:51fce64e52e120ccfca89044f473246f9b7bcf91df9d86eba915c7f17e1aecc8","observation_id":"59b15c4c-8ebb-45b7-b18a-d67fc4e75293","resolution":{"observed_at":"2026-08-10T14:55:02.043051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.046632Z","title":null,"venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.046632Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e93275e0f734adfd97c18275a5f72f45eb4ee0c1b4578335af455e8f38101031","observation_id":"31d22bdb-6423-4d7c-b551-c7576b6efdd1","resolution":{"observed_at":"2026-08-10T14:55:02.046632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05451","last_updated":"2024-08-10T06:11:48Z","snapshot_observed_at":"2026-08-12T23:05:41.494718Z","submitted_at":"2024-08-10T06:11:48Z","title":"Mathematical Models of Computation in Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05451","snapshot_observed_at":"2026-08-10T14:55:02.050076Z","title":"Mathematical models of computation in superposition, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.050076Z"},"links":{"cited_paper":"/paper/2408.05451","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:53b4cf06627ee16e2745d09697bade01cc97066b81b5fd580a062eee9bb0bf23","observation_id":"7b68efe4-0b30-496b-92a4-11f81b2f98d3","resolution":{"observed_at":"2026-08-10T14:55:02.050076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.054098Z","title":"Jacobs, Michael I","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.054098Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f75d5e25a470b5c7eef1bcf211154a9cb9363f194c09a7244a3ee542dc50edbf","observation_id":"03117473-def8-40a7-9cfa-f4d34cc3d4ac","resolution":{"observed_at":"2026-08-10T14:55:02.054098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.057917Z","title":"Polysemantic attention head in a 4-layer transformer, Nov 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.057917Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:66a774c164388b93c36ec46cfa4536144dddd6a2414e988a9c07ea9626012d0d","observation_id":"87c78947-4ce7-4a4e-aea2-2cd111d9b2f7","resolution":{"observed_at":"2026-08-10T14:55:02.057917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.061574Z","title":"Attention head superposition, May 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.061574Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a7bf02d04f019a57d3e21d03b6eddd793265b38a67ccb6a05c84450689c8ba68","observation_id":"5a127bcf-b2bc-4b05-9636-1238ef28e54a","resolution":{"observed_at":"2026-08-10T14:55:02.061574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.065337Z","title":"Tanh penalty in dictionary learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.065337Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:d9cdff40934761c177e4e8ebcfb183604d31c8c1208bdd3449639afa65bdc96e","observation_id":"a8f4edbc-d8a3-4648-be3c-0f7950c0ea0a","resolution":{"observed_at":"2026-08-10T14:55:02.065337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.069060Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.069060Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:bfc483fb35639ebff72b66f7d0ce9c617df4d6844fc1bdeddb69e93c219ee1e8","observation_id":"000081ae-18c9-4598-aaeb-77de74c9ecdc","resolution":{"observed_at":"2026-08-10T14:55:02.069060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.072574Z","title":"Knechtli, M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.072574Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:417aaaaa9bea0cbb7ea91b70d53b7f2429cc18596d7137003539edce85c18688","observation_id":"87a9e57e-b220-48c7-8bb7-ef920ac1b907","resolution":{"observed_at":"2026-08-10T14:55:02.072574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00745","last_updated":"2024-03-01T18:43:51Z","snapshot_observed_at":"2026-08-13T04:05:21.084919Z","submitted_at":"2024-03-01T18:43:51Z","title":"AtP*: An efficient and scalable method for localizing LLM behaviour to components","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00745","snapshot_observed_at":"2026-08-10T14:55:02.076326Z","title":"Atp*: An efficient and scalable method for localizing llm behaviour to components, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.076326Z"},"links":{"cited_paper":"/paper/2403.00745","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9b644627e5a59b0eabb14161f144f95fac447da1376e297c5df2ff3d57175670","observation_id":"4dc3b048-ff07-46d0-b532-91eb721ae6a2","resolution":{"observed_at":"2026-08-10T14:55:02.076326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.080342Z","title":"Optimal brain damage","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.080342Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5de3ec988e987cf648b1b4ae5fbb202805f186c8d76e0bd3429ed724ed3123dd","observation_id":"ad53358e-91d1-4a49-817a-606c6c58cb78","resolution":{"observed_at":"2026-08-10T14:55:02.080342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.383718Z","title":"Sparse deep belief net model for visual area v2","venue":null,"work_id":"c178b77a-70a1-4dfc-8003-a8982340de91","year":2007},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.084307Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:024014b84343c1074c0ddd877d07d5c74c2e4d886a064aa7c39dddb065efb96a","observation_id":"e0ea3d51-4641-423a-9319-c04bd492970c","resolution":{"observed_at":"2026-08-10T14:55:03.387622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10884","last_updated":"2023-11-06T19:25:02Z","snapshot_observed_at":"2026-08-13T12:58:03.114173Z","submitted_at":"2023-01-26T00:53:11Z","title":"Break It Down: Evidence for Structural Compositionality in Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10884","snapshot_observed_at":"2026-08-10T14:55:02.087913Z","title":"Lepori, Thomas Serre, and Ellie Pavlick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.087913Z"},"links":{"cited_paper":"/paper/2301.10884","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:22fc1015ab56f40576e44c46061cd444f3b2d249b4c79a172446514f5f2fce31","observation_id":"9de2a273-ae2e-4abd-81fe-c361c33ac11e","resolution":{"observed_at":"2026-08-10T14:55:02.087913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.091682Z","title":"Measuring the intrinsic dimension of objective landscapes, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.091682Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:fa3c048ae78b867387ca69ad5e03181c71ad54b1e9f38cfe73529cdf234a9456","observation_id":"9bad77fd-1515-470f-9938-01db5c3824ca","resolution":{"observed_at":"2026-08-10T14:55:02.091682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07543","last_updated":"2016-02-28T22:04:54Z","snapshot_observed_at":"2026-08-03T16:55:19.885866Z","submitted_at":"2015-11-24T02:31:46Z","title":"Convergent Learning: Do different neural networks learn the same representations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07543","snapshot_observed_at":"2026-08-10T14:55:02.095279Z","title":"Convergent learning: Do different neural networks learn the same representations?, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.095279Z"},"links":{"cited_paper":"/paper/1511.07543","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1844c993457da3595cb726fa919580a4e5657587cfb9d0e1524b07b46530422a","observation_id":"58ffde52-cb39-4fcc-916f-b7a6e57402ae","resolution":{"observed_at":"2026-08-10T14:55:02.095279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.099277Z","title":"Sparse crosscoders for cross-layer features and model diffing, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.099277Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ba83e4deb7e92b4a2b85c82dd9301c132bdd76cfad81c8034f34c74f8e6bf586","observation_id":"46e32e6c-8df0-499c-8b32-7ac1d82b37a8","resolution":{"observed_at":"2026-08-10T14:55:02.099277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T14:55:02.102887Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.102887Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:50e2d7fd755a54eb4f7395db58084c4b1fde3b912c8ca9d723717afed5bb4af4","observation_id":"845b9c97-f3d6-4de5-8330-3c630df2878b","resolution":{"observed_at":"2026-08-10T14:55:02.102887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.360401Z","title":"Towards principled evaluations of sparse autoencoders for interpretability and control","venue":null,"work_id":"7b824af4-b668-4041-9e82-4e8b539bb491","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.107015Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:32a6dfc8a03cf40ecc45d070e5933f9c7f1aec0cfab939cabfb32b92a0360b22","observation_id":"331cce98-8d87-40f7-aba9-ff24e5432c19","resolution":{"observed_at":"2026-08-10T14:55:03.364189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5663","last_updated":"2014-03-22T17:12:07Z","snapshot_observed_at":"2026-08-01T16:20:01.675800Z","submitted_at":"2013-12-19T17:46:46Z","title":"k-Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5663","snapshot_observed_at":"2026-08-10T14:55:02.110319Z","title":"K-sparse autoencoders","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.110319Z"},"links":{"cited_paper":"/paper/1312.5663","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:4158e2519be0dc6e44e4c136304520a705b48e4e430c5a9db84219d9a4cba98b","observation_id":"b5d8c57a-bd40-40cb-811f-fe9ad47dd6e4","resolution":{"observed_at":"2026-08-10T14:55:02.110319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-08-14T07:35:01.333549Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-10T14:55:02.114088Z","title":"Sparse feature circuits: Discovering and editing interpretable causal graphs in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.114088Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:0372c068ce93264204593c650c9216b5e866d916147d98ab0d0bc59182fc7598","observation_id":"6834a095-b374-4651-9123-b814e92f7d5a","resolution":{"observed_at":"2026-08-10T14:55:02.114088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.347732Z","title":"Gated attention blocks: Preliminary progress toward removing attention head superposition","venue":null,"work_id":"8d9466e1-e1af-445d-a053-c6a648cade08","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.117834Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9fbd192425e9db17fb31fd6a65b414d65e956f3b42773fb1852ed74689d0f523","observation_id":"b781cdef-b4b0-4eed-9b57-315f6e80de7b","resolution":{"observed_at":"2026-08-10T14:55:03.352088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.336404Z","title":"McClelland and David E","venue":null,"work_id":"d8c37ad8-dcd8-4f56-8c27-db500fcd5c02","year":1985},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.121329Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f59023c9a88eb88c401e9846aba549f8520038e83da73ed6ba79696248d80bd6","observation_id":"5fe6a4c4-e882-495b-8f9c-af03bdb5133f","resolution":{"observed_at":"2026-08-10T14:55:03.340242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.324921Z","title":"Singular value representation: A new graph perspective on neural networks","venue":null,"work_id":"180014a9-3107-4d64-a9cc-dd8fb4a7f0f0","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.124864Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:100ecf39afdc0747ca3b650310fc1f987909fb87fdcd7f535a7f8975ba8c83de","observation_id":"03a23172-c94a-442f-a85a-7d6577c07f17","resolution":{"observed_at":"2026-08-10T14:55:03.329072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.313227Z","title":"Sae feature geometry is outside the superposition hypothesis, Sep 2024","venue":null,"work_id":"b2d8a6b6-e58e-475e-9154-07e45f1f6770","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.128466Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f34a0f5bcc1fa40845f42e1c62007af96d90caa27ed3e9a45e253f8406759f33","observation_id":"a07837f8-5e87-479d-81a6-64996ac5fe4c","resolution":{"observed_at":"2026-08-10T14:55:03.317228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.302402Z","title":"Locating and editing factual associations in gpt, 2023 a","venue":null,"work_id":"433121f6-aabd-43d5-9754-5f38195763c3","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.132171Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:21417d77ad096e1eb7e14d8821bc959c2fe0badd086769fa3becd8e83dd0b5b2","observation_id":"6287fb88-e5a9-49a1-aa80-5aa1a46dd0bf","resolution":{"observed_at":"2026-08-10T14:55:03.306178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-08-13T02:17:30.405636Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-10T14:55:02.135872Z","title":"Mass-editing memory in a transformer, 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.135872Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ab60e2dcf071643d9de5bd156939b3eca385f2fe235e74d9231909ec030ffc72","observation_id":"c52c97b4-67f4-4fea-8c0c-5bfc2ca0d538","resolution":{"observed_at":"2026-08-10T14:55:02.135872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13506","last_updated":"2024-01-13T23:51:39Z","snapshot_observed_at":"2026-08-13T12:18:11.077630Z","submitted_at":"2023-03-23T17:58:43Z","title":"The Quantization Model of Neural Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13506","snapshot_observed_at":"2026-08-10T14:55:02.139710Z","title":"Michaud, Ziming Liu, Uzay Girit, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.139710Z"},"links":{"cited_paper":"/paper/2303.13506","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:7cba0b00795a56865ab5fd777002d8755c7012074f06971311a46fec43091a66","observation_id":"fadf4aad-8399-4619-8291-20941ad88368","resolution":{"observed_at":"2026-08-10T14:55:02.139710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.291775Z","title":"The singular value decompositions of transformer weight matrices are highly interpretable, Nov 2022","venue":null,"work_id":"4eeca747-c4ab-4a30-bd8c-d05423c9ad32","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.143844Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:494e070372f3707adb60c31eb7eb9593b7e13b9d5073dbdb0c1ba979eb38082b","observation_id":"8d7914cc-6360-4120-9e4a-3c8e1439aca2","resolution":{"observed_at":"2026-08-10T14:55:03.295667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.06440","last_updated":"2017-06-08T19:53:26Z","snapshot_observed_at":"2026-08-07T07:29:29.524604Z","submitted_at":"2016-11-19T22:48:30Z","title":"Pruning Convolutional Neural Networks for Resource Efficient Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.06440","snapshot_observed_at":"2026-08-10T14:55:02.147411Z","title":"Pruning convolutional neural networks for resource efficient inference, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.147411Z"},"links":{"cited_paper":"/paper/1611.06440","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:107b00493e10f711186429fef139c3609a9df9fc600c1ab14e630b9ea40028fc","observation_id":"ec4abf73-5a8b-4fc7-8f81-55987805304e","resolution":{"observed_at":"2026-08-10T14:55:02.147411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01434","last_updated":"2025-06-23T09:05:58Z","snapshot_observed_at":"2026-08-13T13:25:34.116595Z","submitted_at":"2024-10-02T11:36:45Z","title":"Circuit Compositions: Exploring Modular Structures in Transformer-Based Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01434","snapshot_observed_at":"2026-08-10T14:55:02.151456Z","title":"Circuit compositions: Exploring modular structures in transformer-based language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.151456Z"},"links":{"cited_paper":"/paper/2410.01434","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:649de54a9136fabdaa974a1be4c8c430f3eab05c4f82fccf6bc14b9ee56db012","observation_id":"e2919f8f-76c8-4477-8c12-77ceb7f69939","resolution":{"observed_at":"2026-08-10T14:55:02.151456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.06959","last_updated":"2018-05-22T09:55:52Z","snapshot_observed_at":"2026-07-06T06:29:01.762510Z","submitted_at":"2018-03-19T14:42:19Z","title":"On the importance of single directions for generalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.06959","snapshot_observed_at":"2026-08-10T14:55:02.155256Z","title":"Morcos, David G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.155256Z"},"links":{"cited_paper":"/paper/1803.06959","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:66032b05e72fc4efc58f7de8abae0132d756a47423756d34d6ae5f9a7fe8e091","observation_id":"27b7520c-61e7-4772-bfb8-c3d9745786c0","resolution":{"observed_at":"2026-08-10T14:55:02.155256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.159103Z","title":"Skeletonization: A technique for trimming the fat from a network via relevance assessment","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.159103Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ca6c7b772d15846edb9cb400563d2315a109ddf232c99fe89b1c3d8c3dd5cf54","observation_id":"49ed94da-e321-4735-84ce-ce96e7d4d2e5","resolution":{"observed_at":"2026-08-10T14:55:02.159103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.272594Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"eb820f6f-a2f3-422e-b858-283eb0720e9e","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.162392Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f43f8c199f0112896eee75b3b8017d3b5850cfb64579892cd7176bbfd652f718","observation_id":"b98f766f-a2fc-4676-98d8-aeb67bbfcfa1","resolution":{"observed_at":"2026-08-10T14:55:03.276701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.259946Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"7f0fc166-6a57-420c-b8f5-e1c32080fe85","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.165761Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ab0405aa99aaece72183aca6391644788571d15806c40dc99d034bc02c6dbdb3","observation_id":"1374f3d1-bc6d-48ac-b5ac-7f66034b2934","resolution":{"observed_at":"2026-08-10T14:55:03.264069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.03616","last_updated":"2016-05-07T06:30:51Z","snapshot_observed_at":"2026-07-06T04:45:49.467632Z","submitted_at":"2016-02-11T05:10:42Z","title":"Multifaceted Feature Visualization: Uncovering the Different Types of Features Learned By Each Neuron in Deep Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.03616","snapshot_observed_at":"2026-08-10T14:55:02.169387Z","title":"Multifaceted feature visualization: Uncovering the different types of features learned by each neuron in deep neural networks, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.169387Z"},"links":{"cited_paper":"/paper/1602.03616","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5cb65092302dd581dafef8dbb5ced5fd4e5cf29c28118a00458c96d469a5fc41","observation_id":"08ade89d-594f-4317-a75f-d3b6ec60a05c","resolution":{"observed_at":"2026-08-10T14:55:02.169387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.248412Z","title":"interpreting gpt: the logit lens, August 2020","venue":null,"work_id":"08bbcf49-145d-4305-9bd1-2aea336d0b22","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.175775Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1295bd1792744c0032c8ffb2d6d12a6b64d7cc81a24fac88370f180c4885997b","observation_id":"92a4349c-eb65-456d-800c-8d576feb9b08","resolution":{"observed_at":"2026-08-10T14:55:03.252185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.235317Z","title":"Weight superposition, May 2023","venue":null,"work_id":"06709a9a-8a1f-4a3d-8ed0-dac92490444a","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.179883Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:92107701bcbafb2b6340cb0ab64b470805fa226096a7663f95ba5621a1cf9af5","observation_id":"dc7767ef-0762-4056-bc71-29acaebb861d","resolution":{"observed_at":"2026-08-10T14:55:03.239294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.223696Z","title":"The next five hurdles, July 2024 a","venue":null,"work_id":"1b0e2cc2-2712-4109-b785-15f2af52a56b","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.183450Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a97672f31ebce07824745e25dde831c2b997c35ef61464cc90f12769a91e74c3","observation_id":"3cc897ff-fb3e-4020-826a-5a91854da724","resolution":{"observed_at":"2026-08-10T14:55:03.227224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.212592Z","title":"What is a linear representation? what is a multidimensional feature?, July 2024 b","venue":null,"work_id":"8be63764-db6f-43ed-9549-bf5b614f7756","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.186839Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b36ad711c89cf76fd4bcdf8ea3e31be8ec00a7b88e03644ed165df3d8b93857c","observation_id":"6b1383cf-8fec-4f0a-b5e9-0645cc86932a","resolution":{"observed_at":"2026-08-10T14:55:03.216649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.190525Z","title":"An overview of early vision in inceptionv1","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.190525Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:79255eecbaa72e95de45abd98e3633503a5cc847a3f5a3a460b6ad5aa07d3e12","observation_id":"49546271-21b0-4089-b05c-35f015aa3fda","resolution":{"observed_at":"2026-08-10T14:55:02.190525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.201372Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":"d3859e2c-99b2-4f4d-954a-5bc0aabc0e4e","year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.193950Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:b749621e9a7099eeae8aa0df1a971f77ec69d4a04f17db0b5a63dd6f15ff35ed","observation_id":"243994dc-b4c8-4faf-afb4-ee8edacceb51","resolution":{"observed_at":"2026-08-10T14:55:03.205141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04139","last_updated":"2025-06-11T07:36:27Z","snapshot_observed_at":"2026-08-12T00:26:00.692458Z","submitted_at":"2024-12-05T13:06:03Z","title":"Monet: Mixture of Monosemantic Experts for Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04139","snapshot_observed_at":"2026-08-10T14:55:02.197434Z","title":"Monet: Mixture of monosemantic experts for transformers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.197434Z"},"links":{"cited_paper":"/paper/2412.04139","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:2f3af98b95e29110d4bb0f3b6da8fa4ec09e012abcafba9a7dbfb956da836b20","observation_id":"e3e18910-6f01-4337-ad66-3b0d06010f01","resolution":{"observed_at":"2026-08-10T14:55:02.197434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18402","last_updated":"2023-10-27T19:44:41Z","snapshot_observed_at":"2026-08-13T11:30:49.309818Z","submitted_at":"2023-05-28T15:12:32Z","title":"Neural Sculpting: Uncovering hierarchically modular task structure in neural networks through pruning and network analysis","version":3},"cited_work":{"arxiv_id":"2305.18402","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.18402","snapshot_observed_at":"2026-08-10T14:55:02.477356Z","title":"Neural Sculpting: Uncovering hierarchically modular task structure in neural networks through pruning and network analysis","venue":"cs.LG","work_id":"f60aed66-ce69-4183-8787-8c12ff4238a9","year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.201091Z"},"links":{"cited_paper":"/paper/2305.18402","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f6c3a4b1e34aaaaac455ed0694f7b8e5cc00c693d0d77cd12cc83289e629e00c","observation_id":"910a6b16-b162-447d-bd62-2bfe8d388ef1","resolution":{"observed_at":"2026-08-10T14:55:02.481775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03947","last_updated":"2024-06-06T10:46:51Z","snapshot_observed_at":"2026-08-13T09:55:55.500625Z","submitted_at":"2024-06-06T10:46:51Z","title":"Weight-based Decomposition: A Case for Bilinear MLPs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03947","snapshot_observed_at":"2026-08-10T14:55:02.205020Z","title":"Pearce, Thomas Dooms, and Alice Rigg","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.205020Z"},"links":{"cited_paper":"/paper/2406.03947","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5699f8f931655c216b84bdec06232f69a02a612d0c3c99fa21299128a1dbdfcc","observation_id":"819e658e-e88e-4ba8-a14c-e9a8c1919376","resolution":{"observed_at":"2026-08-10T14:55:02.205020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08417","last_updated":"2025-06-25T10:36:59Z","snapshot_observed_at":"2026-08-13T04:30:12.163954Z","submitted_at":"2024-10-10T23:22:11Z","title":"Bilinear MLPs enable weight-based mechanistic interpretability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08417","snapshot_observed_at":"2026-08-10T14:55:02.209060Z","title":"Pearce, Thomas Dooms, Alice Rigg, Jose M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.209060Z"},"links":{"cited_paper":"/paper/2410.08417","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:daaba9adcb459f069800bc58ccbb6e5b272cb3df95e88c49ee430cdeaa1b9b5d","observation_id":"aac334ca-267f-478c-a708-e23b1d51c23f","resolution":{"observed_at":"2026-08-10T14:55:02.209060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.23915/distill.00024.009","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.334117Z","title":"Weight banding","venue":null,"work_id":"2240dc73-fb0a-4eec-a31b-cbf2cc9ced71","year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.212950Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:e3cefa88add45e62f6a30ca7b5110a8e2cbf357dd6da68beb015ffe7c079bc37","observation_id":"2dcc5a60-cc86-4dcf-ad3c-2bf4592674d1","resolution":{"observed_at":"2026-08-10T14:55:02.339107Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06876","last_updated":"2019-11-15T21:10:50Z","snapshot_observed_at":"2026-08-02T13:21:31.688461Z","submitted_at":"2019-11-15T21:10:50Z","title":"Explanatory Masks for Neural Network Interpretability","version":1},"cited_work":{"arxiv_id":"1911.06876","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.06876","snapshot_observed_at":"2026-08-10T14:55:02.442089Z","title":"Explanatory Masks for Neural Network Interpretability","venue":"cs.LG","work_id":"f42d32a7-8677-4f9e-b889-0917213bef0f","year":2019},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.217085Z"},"links":{"cited_paper":"/paper/1911.06876","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ad47d3002d3ee5eeb9bda54fec83d6f0d4af764e76b24e92af3de999233f4fca","observation_id":"a07a3579-6e7d-4cd3-af3f-134c2ec52a07","resolution":{"observed_at":"2026-08-10T14:55:02.447075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.190076Z","title":"Rumelhart, Geoffrey E","venue":null,"work_id":"516aded3-84c5-44a2-afb2-ae5e285aae68","year":1986},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.221652Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ef4dfe86a20822429a057e878dd6a5eff02fc14d1578ef8431db64256e15cdb6","observation_id":"c023110c-7bee-4db3-87b1-4e64957811c6","resolution":{"observed_at":"2026-08-10T14:55:03.193658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.179023Z","title":"Sparsify: A mechanistic interpretability research agenda, April 2024","venue":null,"work_id":"98c155b1-7258-45e5-8af7-a60c757291c5","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.225323Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:70601fba9f0af86292d40a3daed86c4d6aa4a90f8f9b41eca261ec878d249b90","observation_id":"f161cfbf-a8a4-484f-b798-e2f72d98a296","resolution":{"observed_at":"2026-08-10T14:55:03.182804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.229021Z","title":"Taking features out of superposition with sparse autoencoders, Dec 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.229021Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9db2f4cee602a397fa59a2608c7c90941826b1ba63a27ca5cce0964d7d52866b","observation_id":"54f09e4d-853f-4c21-b5b3-fe2dba7a60ed","resolution":{"observed_at":"2026-08-10T14:55:02.229021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-10T14:55:02.232925Z","title":"Michaud, Stephen Casper, Max Tegmark, William Saunders, David Bau, Eric Todd, Atticus Geiger, Mor Geva, Jesse Hoogland, Daniel Murfet, and Tom McGrath","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.232925Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ac4d4ac4940548a2f206b12655f4b850ffd9905f721aac838c5c53cec0b5dffa","observation_id":"5d1fdc47-bc03-46b5-b430-4f90cb9c1ea1","resolution":{"observed_at":"2026-08-10T14:55:02.232925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.237281Z","title":"Dropout: A simple way to prevent neural networks from overfitting","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.237281Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:9f5c6dfd6c65733017f9b895416dc3e21784c616faf469cadd17d4c569e40251","observation_id":"acf6724a-f502-4933-9f6b-c2fe1490364d","resolution":{"observed_at":"2026-08-10T14:55:02.237281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.240996Z","title":"Axiomatic attribution for deep networks, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.240996Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:c90d06ad80c9e772d422799470bd460bf367b8d7300e8a033e235f0e2c146295","observation_id":"1a166d52-8cc1-4aed-bea8-89c523f8bfd9","resolution":{"observed_at":"2026-08-10T14:55:02.240996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10348","last_updated":"2023-11-20T11:31:16Z","snapshot_observed_at":"2026-08-13T14:10:00.082810Z","submitted_at":"2023-10-16T12:34:43Z","title":"Attribution Patching Outperforms Automated Circuit Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10348","snapshot_observed_at":"2026-08-10T14:55:02.244675Z","title":"Attribution patching outperforms automated circuit discovery, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.244675Z"},"links":{"cited_paper":"/paper/2310.10348","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:3c602f4201e36a2bd898ec685dc93c70cb2a2f6ff460a9dfb15281527b0b9ddb","observation_id":"365fa9a5-2ec5-48e9-9c2b-8f25d1773552","resolution":{"observed_at":"2026-08-10T14:55:02.244675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.248489Z","title":"true features","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.248489Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:267c4650e96c34889818c0a6b5c0bbb376fddc0e50cc007d54633dce45981c05","observation_id":"913a9a47-88bf-4854-96a8-981f6f9d8455","resolution":{"observed_at":"2026-08-10T14:55:02.248489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.143382Z","title":"Toward a mathematical framework for computation in superposition, Jan 2024","venue":null,"work_id":"cfbf7b5c-6e81-4f0c-b2de-f29e7ecdb481","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.252131Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:5dbfe04cc33cdf7f9e07f8bff2a4f4883fa681062c7d6ca0106da121aa2d6e78","observation_id":"f8a613b4-c457-4b60-bd29-20ce2b407a8b","resolution":{"observed_at":"2026-08-10T14:55:03.147118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.132114Z","title":"Residual networks behave like ensembles of relatively shallow networks, 2016","venue":null,"work_id":"44e87196-dcb4-42cc-8a0a-0d674e144176","year":2016},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.256033Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f38f36796558461eec9619ab1c2b40a55305b0f58cb9adc54cce7f55ec67d423","observation_id":"2a14ff0d-55de-4ad8-ac87-3dcbb03fbbc5","resolution":{"observed_at":"2026-08-10T14:55:03.135959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.259446Z","title":"Causal mediation analysis for interpreting neural nlp: The case of gender bias, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.259446Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a65cdd04f93fb9e76e4a107c9b8df7cc7ef1a0c67d885a02a58ab319f64eafca","observation_id":"53b277d9-50c4-4f17-b84a-ae32a49855cd","resolution":{"observed_at":"2026-08-10T14:55:02.259446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.262889Z","title":"Visualizing weights","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.262889Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ab6e76a2e0f79e8057e43d721fd629a749bf0fc4eaba9814b2ece9f098cf283e","observation_id":"1c87052b-bbff-461b-857f-87f917c4e241","resolution":{"observed_at":"2026-08-10T14:55:02.262889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02984","last_updated":"2024-10-03T20:51:02Z","snapshot_observed_at":"2026-08-13T10:03:33.123637Z","submitted_at":"2024-10-03T20:51:02Z","title":"Differentiation and Specialization of Attention Heads via the Refined Local Learning Coefficient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02984","snapshot_observed_at":"2026-08-10T14:55:02.266549Z","title":"Differentiation and specialization of attention heads via the refined local learning coefficient, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.266549Z"},"links":{"cited_paper":"/paper/2410.02984","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:a53de1055ee3733df18bd3903add780f7de8b6c97e286d3251a8f12b08884c34","observation_id":"bc79648e-9b45-462e-8880-808f654d0a90","resolution":{"observed_at":"2026-08-10T14:55:02.266549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-10T14:55:02.270268Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.270268Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1ac62179ceac0f6d4e19d72b15509384af77f4b1b8fe3985de1e593196b077bf","observation_id":"afab162a-b487-4298-9b9a-441122dd8fd5","resolution":{"observed_at":"2026-08-10T14:55:02.270268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.273821Z","title":"Algebraic geometry and statistical learning theory, volume 25","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.273821Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:222f3e8640585715d8e50403b5b9f1a39bf86595518ac3c18c4718d39bc4dbdc","observation_id":"c67c9982-effc-4715-8cba-4de6553e2ed8","resolution":{"observed_at":"2026-08-10T14:55:02.273821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:02.277248Z","title":"Addressing feature suppression in saes, Feb 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.277248Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:1fa79185b098da907996e1b0d2eb075730292e7f3effd57ac904d92a3d03d828","observation_id":"5032a9a4-3397-4454-8d39-f6bf04781513","resolution":{"observed_at":"2026-08-10T14:55:02.277248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.101053Z","title":"Decomposing the qk circuit with bilinear sparse dictionary learning, July 2024","venue":null,"work_id":"f60a1e8e-3225-43b6-9751-5c9616515212","year":2024},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.280850Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:ead5bf67a009fd77e5bf826635f346a44d258c82ea79c224b420a401f0dd1591","observation_id":"f0b4bf34-7058-46f3-8ec0-6e6889796caa","resolution":{"observed_at":"2026-08-10T14:55:03.104946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15949","last_updated":"2023-04-04T06:43:19Z","snapshot_observed_at":"2026-07-06T10:54:39.400060Z","submitted_at":"2021-03-29T20:51:33Z","title":"Transformer visualization via dictionary learning: contextualized embedding as a linear superposition of transformer factors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15949","snapshot_observed_at":"2026-08-10T14:55:02.284507Z","title":"Transformer visualization via dictionary learning: contextualized embedding as a linear superposition of transformer factors, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.284507Z"},"links":{"cited_paper":"/paper/2103.15949","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:3e63745ca3b68ea78a51b1447769e0ca74c1ce4a7821e450ab62249293afb579","observation_id":"07644e3b-7f55-436e-bf61-ead212f82cc6","resolution":{"observed_at":"2026-08-10T14:55:02.284507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03530","last_updated":"2017-02-26T19:36:40Z","snapshot_observed_at":"2026-08-01T16:56:59.989486Z","submitted_at":"2016-11-10T22:02:36Z","title":"Understanding deep learning requires rethinking generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.03530","snapshot_observed_at":"2026-08-10T14:55:02.288353Z","title":"Understanding deep learning requires rethinking generalization, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.288353Z"},"links":{"cited_paper":"/paper/1611.03530","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:55a5d02b6211d01ae8ea80d163d7f6098bc4f313055357884a9097ccba64fd9f","observation_id":"0d66d4f7-5417-49f3-be64-af18a795f56b","resolution":{"observed_at":"2026-08-10T14:55:02.288353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02890","last_updated":"2021-06-05T13:19:27Z","snapshot_observed_at":"2026-08-13T19:09:30.126518Z","submitted_at":"2021-06-05T13:19:27Z","title":"Can Subnetwork Structure be the Key to Out-of-Distribution Generalization?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02890","snapshot_observed_at":"2026-08-10T14:55:02.292272Z","title":"Can subnetwork structure be the key to out-of-distribution generalization?, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.292272Z"},"links":{"cited_paper":"/paper/2106.02890","citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:fc50e9970df950a26817295f1b5827f3754cb124b0f432d5a95f3e3115a8aaf9","observation_id":"7ab53c8e-0d78-4977-bd66-0b10c97c2998","resolution":{"observed_at":"2026-08-10T14:55:02.292272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:55:03.090460Z","title":"Moefication: Transformer feed-forward layers are mixtures of experts, 2022","venue":null,"work_id":"e2755554-8e0b-41c7-b759-48ba809519ad","year":2022},"citing_paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition","version":4},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-10T14:55:02.296395Z"},"links":{"citing_paper":"/paper/2501.14926"},"observation_digest":"sha256:f55282f93c690deab869f24905faf8454a793dabac85a56c87a3bf3ffec6b82c","observation_id":"66863b85-3a43-49a3-8e0e-ee70125fd2b6","resolution":{"observed_at":"2026-08-10T14:55:03.094226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14926","last_updated":"2025-02-07T19:22:32Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T20:32:39.500769Z","submitted_at":"2025-01-24T21:31:12Z","title":"Interpretability in Parameter Space: Minimizing Mechanistic Description Length with Attribution-based Parameter Decomposition"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":70,"verified_exact":7,"verified_fuzzy":21},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 14 inbound Pith citation observations for arXiv:2501.14926."}