{"as_of":"2026-08-20T13:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc12ba9f465e2de2e0ead1e1b32c4cd0945911e6f9422c64ffced9d0bcbed445","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":40,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:57:30.012689Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":32,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-24T06:42:23.274826Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2309.08600"},"observation_digest":"sha256:953781156b3fff387a096f69d89ecc3f802d5e86b757b43b1b6b9f7ef6b7d6e0","observation_id":"b618ee32-d664-46f8-9765-d3fc53dce4d8","resolution":{"observed_at":"2026-05-24T06:44:02.183406Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-08-12T21:46:28.191953Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T20:34:06.888683Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2404.15255"},"observation_digest":"sha256:eb9059032292a517fc74b14fd085392361c1f62df418124540a40a49868f3e5b","observation_id":"58bcce53-5c39-481b-9cde-cd4d88398c66","resolution":{"observed_at":"2026-05-16T20:34:06.914206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T05:47:19.953111Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2408.05147"},"observation_digest":"sha256:c1ac9875fc7c31ff5295fb89fe575cb0b08fb22f1e0429fc4df92a133ac30c4b","observation_id":"82f206c9-eff3-4bc6-a355-f557798bbec4","resolution":{"observed_at":"2026-05-15T05:47:20.036422Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-10T04:36:43.804112Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.17755","last_updated":"2025-03-05T16:20:03Z","snapshot_observed_at":"2026-08-16T22:27:37.712481Z","submitted_at":"2025-01-29T16:48:13Z","title":"AI Governance through Markets","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T04:36:43.804112Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2501.17755"},"observation_digest":"sha256:ddc6bc18169c7f86ea38dd49b6e6057b485ed169f859a89907a51c899e4311c5","observation_id":"dbb44eab-a1fb-4e01-b41e-698aeab39382","resolution":{"observed_at":"2026-08-10T04:36:43.804112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-09T22:24:53.827765Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.827765Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:a5a8c40cf4d1df78148118164147f4d9f53c21442bf10e1c8ed72a6799966697","observation_id":"69061fed-e49d-4c2b-8b98-dd09645abde2","resolution":{"observed_at":"2026-08-09T22:24:53.827765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-09T17:58:34.145737Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimer- sheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00726","last_updated":"2025-02-02T09:15:27Z","snapshot_observed_at":"2026-08-13T16:36:49.694606Z","submitted_at":"2025-02-02T09:15:27Z","title":"Perspectives for Direct Interpretability in Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:58:34.145737Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2502.00726"},"observation_digest":"sha256:c465f4fdb9fbf4817adc1b255deb1820f773a458c85aac62081f32cb8012a98e","observation_id":"c689dd0f-0093-4237-bcae-33c9267541da","resolution":{"observed_at":"2026-08-09T17:58:34.145737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-16T05:57:30.012689Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19475","last_updated":"2025-06-03T06:43:53Z","snapshot_observed_at":"2026-08-19T09:56:20.929176Z","submitted_at":"2025-04-28T04:31:24Z","title":"Prisma: An Open Source Toolkit for Mechanistic Interpretability in Vision and Video","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:57:30.012689Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2504.19475"},"observation_digest":"sha256:64de4b79000106edd31f30f80ab1ac8e3f83f42d9b09f89e9beab665df754d62","observation_id":"47bd69df-1e0c-4a37-a7f3-eab94ca8412b","resolution":{"observed_at":"2026-08-16T05:57:30.012689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-16T04:25:05.678871Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01372","last_updated":"2025-05-02T16:18:40Z","snapshot_observed_at":"2026-08-19T03:13:58.617120Z","submitted_at":"2025-05-02T16:18:40Z","title":"Evaluating Explanations: An Explanatory Virtues Framework for Mechanistic Interpretability -- The Strange Science Part I.ii","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T04:25:05.678871Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2505.01372"},"observation_digest":"sha256:9d6dba39ee280f40e280db0f5b21c91172b7963b74fafbba304a2dffde5a3d8f","observation_id":"0bbc4ffc-89aa-4a8a-9228-f21bfc00c894","resolution":{"observed_at":"2026-08-16T04:25:05.678871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-07T15:00:54.375524Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16694","last_updated":"2025-06-10T05:24:12Z","snapshot_observed_at":"2026-08-17T16:20:51.748639Z","submitted_at":"2025-05-22T13:59:30Z","title":"Beyond Induction Heads: In-Context Meta Learning Induces Multi-Phase Circuit Emergence","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:00:54.375524Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2505.16694"},"observation_digest":"sha256:33a8a3aef856b61f1659dc7dd4a2c3f31af13d7bf91114c7c6549c4d8d57b83d","observation_id":"ca0e0547-91ee-4238-a000-c40b0245b7fd","resolution":{"observed_at":"2026-08-07T15:00:54.375524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-07T12:35:36.560849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24731","last_updated":"2025-05-30T15:53:56Z","snapshot_observed_at":"2026-08-16T09:04:15.874605Z","submitted_at":"2025-05-30T15:53:56Z","title":"Circuit Stability Characterizes Language Model Generalization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:36.560849Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2505.24731"},"observation_digest":"sha256:72cbee092bd20c478a20e84fac5456852af758f20d001a338506295aba182e99","observation_id":"7a045aa9-53ee-46d0-948d-5305715a72bb","resolution":{"observed_at":"2026-08-07T12:35:36.560849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T17:37:55.872665Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16109","last_updated":"2025-08-22T05:54:11Z","snapshot_observed_at":"2026-08-11T21:09:52.797279Z","submitted_at":"2025-08-22T05:54:11Z","title":"From Indirect Object Identification to Syllogisms: Exploring Binary Mechanisms in Transformer Circuits","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T17:37:55.872665Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2508.16109"},"observation_digest":"sha256:623a83539f71e52d5edbccc364c5734990a6594676742c5c5b1ab27cfd2bfd0e","observation_id":"e2bfb6fd-c972-4e1d-9227-d18828cdc1fd","resolution":{"observed_at":"2026-08-05T17:37:55.872665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-04T16:40:31.149122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12672","last_updated":"2026-05-23T09:33:32Z","snapshot_observed_at":"2026-08-17T18:37:04.832473Z","submitted_at":"2025-09-16T04:51:18Z","title":"Towards Inclusive Toxic Content Moderation: Addressing Vulnerabilities to Adversarial Attacks in Toxicity Classifiers Tackling LLM-generated Content","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T16:40:31.149122Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2509.12672"},"observation_digest":"sha256:9b8bd5433c4fd488bb8149ac412630dc2bc99830f29898e6aa29ccb3f863aa90","observation_id":"7e2e582d-84cf-4b6f-af44-3536a0ba7fa2","resolution":{"observed_at":"2026-08-04T16:40:31.149122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T06:35:33.648793Z","title":"Cotra, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.22594","last_updated":"2026-06-11T01:15:40Z","snapshot_observed_at":"2026-08-16T08:01:54.323029Z","submitted_at":"2026-01-30T05:41:19Z","title":"Language Model Circuits Are Sparse in the Neuron Basis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T06:35:33.648793Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2601.22594"},"observation_digest":"sha256:29918e457cb5e065094170b5700af8440ff503d607fa3037e2b45d85883b58f1","observation_id":"b5b7cd1b-4e74-4a8a-89b1-e04ac683ef05","resolution":{"observed_at":"2026-08-03T06:35:33.648793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T03:50:15.149847Z","title":"Advances in Neural Information Processing Systems arXiv:2304.14997 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.06841","last_updated":"2026-05-31T17:09:07Z","snapshot_observed_at":"2026-08-09T07:23:34.031341Z","submitted_at":"2026-02-06T16:34:29Z","title":"From Features to Actions: Explainability in Traditional and Agentic AI Systems","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:15.149847Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2602.06841"},"observation_digest":"sha256:ae74ade98590544dc15d59844f25ab867530edd5d959119dd2bbfef1c1ddde1f","observation_id":"935921d7-9ffd-4335-8944-20ba480364d2","resolution":{"observed_at":"2026-08-03T03:50:15.149847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-13T13:35:02.428552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03042","last_updated":"2026-06-04T11:31:33Z","snapshot_observed_at":"2026-08-15T00:46:03.864645Z","submitted_at":"2026-04-03T13:51:23Z","title":"Enhancing Multi-Robot Exploration Using Probabilistic Frontier Prioritization with Dirichlet Process Gaussian Mixtures","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T13:35:02.428552Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.03042"},"observation_digest":"sha256:6baf446586e2c6bcf116ef4c7fcc2a0d77e96f57eaf9da3a8e95062fe5e75f23","observation_id":"2dc8261f-3111-4f91-8dbd-e8464cac9ab0","resolution":{"observed_at":"2026-07-13T13:35:02.428552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.03045","last_updated":"2026-04-03T13:52:57Z","snapshot_observed_at":"2026-08-16T07:52:46.770929Z","submitted_at":"2026-04-03T13:52:57Z","title":"STEAR: Layer-Aware Spatiotemporal Evidence Intervention for Hallucination Mitigation in Video Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:04.999705Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.03045"},"observation_digest":"sha256:7bbbfd2d19c95b9656617a0ab9c58ba102cacdf5a5994439304070c042f6186e","observation_id":"e34a12d1-2961-4a5c-9701-c9a274f3d1eb","resolution":{"observed_at":"2026-05-13T20:18:13.386322Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.19826","last_updated":"2026-04-20T14:47:46Z","snapshot_observed_at":"2026-08-13T22:14:50.133721Z","submitted_at":"2026-04-20T14:47:46Z","title":"Co-Located Tests, Better AI Code: How Test Syntax Structure Affects Foundation Model Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T04:21:39.637962Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.19826"},"observation_digest":"sha256:98fcc32c6396e66683488409dcd4de846f89cbafe2ff51ca4e872c479457036d","observation_id":"614ee7ab-659c-4a58-9fb8-20b114024c09","resolution":{"observed_at":"2026-05-11T12:01:05.319756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2604.22128","last_updated":"2026-06-16T03:20:04Z","snapshot_observed_at":"2026-08-16T11:31:29.590405Z","submitted_at":"2026-04-24T00:26:34Z","title":"Dissociating Decodability and Causal Use in Bracket-Sequence Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T12:12:32.768674Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2604.22128"},"observation_digest":"sha256:734fd720376ca077ca73ddb582761adf0eb93eecef171f717e0213daae2a6d2a","observation_id":"eed9b08f-35e9-45fa-8c7c-311d6d5efd39","resolution":{"observed_at":"2026-05-08T21:39:24.472752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.06335","last_updated":"2026-05-07T14:26:32Z","snapshot_observed_at":"2026-08-16T01:45:51.162494Z","submitted_at":"2026-05-07T14:26:32Z","title":"Eliciting associations between clinical variables from LLMs via comparison questions across populations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-08T12:59:49.837750Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.06335"},"observation_digest":"sha256:704feea05d37b9031d1d19f3fc95d23107d3c802a71fba42131b44c9c937cda4","observation_id":"a28a9de0-9ca5-4305-b7e9-5447e21d31af","resolution":{"observed_at":"2026-05-08T21:34:13.339991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.09881","last_updated":"2026-05-11T02:11:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-11T02:11:47Z","title":"Dissecting Jet-Tagger Through Mechanistic Interpretability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T04:49:09.296991Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.09881"},"observation_digest":"sha256:52561a9792e942b2f712a1cc68904aeccf277c0f3ca92e053e8a01cb8496304d","observation_id":"9c2d2b64-9fae-4120-ac89-28b8c913dea6","resolution":{"observed_at":"2026-05-12T04:51:22.769645Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-08-15T05:36:43.446023Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:d3905c8382dc6dc0b1c66cdff1c671733820cf8b58b29383f327301528c5264a","observation_id":"647671f6-376d-4840-ad97-dd99c985d888","resolution":{"observed_at":"2026-05-14T20:17:53.992568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-08-08T15:53:51Z","snapshot_observed_at":"2026-08-13T23:16:28.421431Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T20:04:57.638215Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:6d772faa5f5bfa7f0ef6e07c05e5f1951f824017fd1a552b98f7979f344f16eb","observation_id":"b9f33560-3e0f-4132-a279-c09b14bc4ff0","resolution":{"observed_at":"2026-05-14T20:07:53.882972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-08-08T15:53:51Z","snapshot_observed_at":"2026-08-13T23:16:28.421431Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T21:30:30.384184Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:1174e1fbcfd11a5ee28d1ae25eeacda82bef5130a4a7f9211ee4a030f2c4d512","observation_id":"3621a9d6-d6ff-4329-8ec4-5fb2336b0556","resolution":{"observed_at":"2026-05-20T21:33:46.486479Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.13625","last_updated":"2026-05-13T14:52:40Z","snapshot_observed_at":"2026-08-15T21:48:01.190422Z","submitted_at":"2026-05-13T14:52:40Z","title":"How to Interpret Agent Behavior","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T18:23:25.269217Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.13625"},"observation_digest":"sha256:f95a34d2352a5ddb9cfcc461196e9e41e9d14bf771a586afc7524793693426e2","observation_id":"bf50b9f1-1011-4798-89dc-6094a9ed5059","resolution":{"observed_at":"2026-05-14T18:27:35.897382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.15183","last_updated":"2026-05-14T17:58:27Z","snapshot_observed_at":"2026-08-15T11:20:50.627173Z","submitted_at":"2026-05-14T17:58:27Z","title":"When Are Two Networks the Same? Tensor Similarity for Mechanistic Interpretability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T03:17:22.217041Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.15183"},"observation_digest":"sha256:8bfb46df32a8c741d12b945f6d0e7c51aa1417468f0b90486a97831335eb918a","observation_id":"2e7032fa-05a0-4eb4-99da-673ba84149d2","resolution":{"observed_at":"2026-05-15T03:19:43.704142Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2605.22462","last_updated":"2026-05-21T13:25:16Z","snapshot_observed_at":"2026-08-16T16:30:36.089383Z","submitted_at":"2026-05-21T13:25:16Z","title":"From Correlation to Cause: A Five-Stage Methodology for Feature Analysis in Transformer Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T06:56:18.332754Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.22462"},"observation_digest":"sha256:19873da898cd2b17f5f21d5b6a36e0834ff6ea827eafb396c3156d6268fedd98","observation_id":"3928ba05-de27-4b63-89f3-4511d7010a7c","resolution":{"observed_at":"2026-05-22T07:01:11.983212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-13T09:07:13.817929Z","title":"Andy Zou, Zifan Wang, Nicholas Carlini, Milad Nasr, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.28825","last_updated":"2026-04-07T18:05:06Z","snapshot_observed_at":"2026-08-15T11:09:53.878581Z","submitted_at":"2026-04-07T18:05:06Z","title":"MechELK: A Mechanistic Interpretability Framework for Eliciting Latent Knowledge in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T09:07:13.817929Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2605.28825"},"observation_digest":"sha256:1434458473f8e846851bd53a7c14f0cc4bdb1b0757e22e8a3015b0ba299c2a0b","observation_id":"a51b679d-5aa3-48e3-a009-2b59bdf01ae2","resolution":{"observed_at":"2026-07-13T09:07:13.817929Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T20:46:01.403927Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:139f8569b0b66a820cfb379ed8691cd48cfbead24b785587c8e8029fca0093a4","observation_id":"5ef6806d-c57c-4110-a422-31cb39da382a","resolution":{"observed_at":"2026-07-04T00:59:21.019640Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T10:20:46.759958Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:e5fa44801fb02adb819d61c5944346dddbb5a6ca9d7637e783668ba32f29d976","observation_id":"8176dc3b-dbf9-46e6-bfec-a7bdc664a3ce","resolution":{"observed_at":"2026-06-30T11:54:39.156734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2607.00924","last_updated":"2026-07-01T13:26:10Z","snapshot_observed_at":"2026-08-07T23:46:28.286621Z","submitted_at":"2026-07-01T13:26:10Z","title":"Graph-Native Reinforcement Learning Enables Traceable Scientific Hypothesis Generation through Conceptual Recombination","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-02T12:26:46.384850Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.00924"},"observation_digest":"sha256:3e51c3997b83dcdc0101030275d471029c5bbd481d0f38743608a266c260c0bd","observation_id":"b0da2d27-f41d-4260-9491-cc950260ffc4","resolution":{"observed_at":"2026-07-02T12:26:55.883819Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":"2304.14997","doi":"10.48550/arxiv.2304.14997","metadata_source":"pith","pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":"cs.LG","work_id":"8407204b-a28a-4ba8-ae13-e7c04d3497c4","year":2023},"citing_paper":{"arxiv_id":"2607.07316","last_updated":"2026-07-08T12:04:38Z","snapshot_observed_at":"2026-08-15T02:54:06.272019Z","submitted_at":"2026-07-08T12:04:38Z","title":"Mechanistic Interpretability for Neural Networks: Circuits, Sparse Features and Symbolic Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-09T14:58:58.363330Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.07316"},"observation_digest":"sha256:779d4fb1afcb615e15311af8f1b98321ce526e4ff37c9bd2fbd30f390aeafc09","observation_id":"44d33f06-a2b5-4278-847a-5d8abde742ba","resolution":{"observed_at":"2026-07-09T15:06:18.046309Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T10:39:48.831071Z","title":"and Lynch, Aengus and Heimersheim, Stefan and Garriga-Alonso, Adrià , month = oct, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T10:39:48.831071Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:e33d4434eda5a9a2e056bc9a407646983898687439ddf85e048c067e8a9e864e","observation_id":"625e0109-428b-4739-9faf-aba305a4a487","resolution":{"observed_at":"2026-08-02T10:39:48.831071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T10:40:01.245170Z","title":"N., Lynch, A., Heimersheim, S., and Garriga-Alonso, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13047","last_updated":"2026-06-19T19:07:38Z","snapshot_observed_at":"2026-08-10T04:42:58.694391Z","submitted_at":"2026-06-19T19:07:38Z","title":"Targeted Recovery of Weight-Space Mechanisms From Neural Networks","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-08-02T10:40:01.245170Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.13047"},"observation_digest":"sha256:6b971fc204aa0b58363d27386c515c23b84fd3be24eae08411d2bc00d2b6d2b0","observation_id":"a9d1c8ec-a8e5-478a-a2af-36ec007339b5","resolution":{"observed_at":"2026-08-02T10:40:01.245170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-01T18:58:29.659933Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17138","last_updated":"2026-07-19T08:50:12Z","snapshot_observed_at":"2026-08-15T00:46:00.007243Z","submitted_at":"2026-07-19T08:50:12Z","title":"Denoising Models Develop Human-Like Perceptual Illusion Representations Across Architectures","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T18:58:29.659933Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.17138"},"observation_digest":"sha256:effba55b88a4ca72451055fbb8de7469a1a4510fb054fd178aa04de64de70778","observation_id":"7bfc993f-2e67-4949-8221-d77f98e3a6f7","resolution":{"observed_at":"2026-08-01T18:58:29.659933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-02T14:26:49.070810Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adri`a Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20436","last_updated":"2026-05-11T13:44:35Z","snapshot_observed_at":"2026-08-16T18:17:56.734765Z","submitted_at":"2026-05-11T13:44:35Z","title":"Routing Subspaces: Auditing Evaluation-to-Deployment Mismatch in Fine-Tuned Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T14:26:49.070810Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.20436"},"observation_digest":"sha256:e179d002fa5ef5c39c081a9e5447e26148dc142417b0dd9e9d06bc4ea0777d68","observation_id":"09a6bc1d-8b09-4c55-ae82-bcf4390311af","resolution":{"observed_at":"2026-08-02T14:26:49.070810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-01T05:25:22.684556Z","title":"arXiv preprint arXiv:2304.14997 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22251","last_updated":"2026-08-07T15:51:17Z","snapshot_observed_at":"2026-08-12T23:12:28.831890Z","submitted_at":"2026-07-24T12:34:46Z","title":"IFCLoRA: Topology-Aware Rank Allocation for Parameter-Efficient Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T05:25:22.684556Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.22251"},"observation_digest":"sha256:e139c799bd2cabce351515f97e7660fafd609294103609fdc5750d5d73a85384","observation_id":"c7406690-c367-4403-b650-4b17f2da9be3","resolution":{"observed_at":"2026-08-01T05:25:22.684556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-07-31T23:35:49.065747Z","title":"N., Lynch, A., Heimersheim, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23927","last_updated":"2026-07-27T01:47:12Z","snapshot_observed_at":"2026-08-16T00:57:41.780490Z","submitted_at":"2026-07-27T01:47:12Z","title":"Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-31T23:35:49.065747Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.23927"},"observation_digest":"sha256:977931d531dc311161eb1fbf80c0f8bf347d566d06121a52fcd24bb481d0b7c3","observation_id":"72e03d84-8e20-482a-970c-1563cb3fd42b","resolution":{"observed_at":"2026-07-31T23:35:49.065747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-03T00:47:35.968722Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28672","last_updated":"2026-07-26T01:32:45Z","snapshot_observed_at":"2026-08-16T09:52:36.564523Z","submitted_at":"2026-07-26T01:32:45Z","title":"LAWFUL: Law-Aligned Witness for Faithful Use of Latents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T00:47:35.968722Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2607.28672"},"observation_digest":"sha256:ca22509f8d1bfb54282506dd77ce8ab02364a4bfdf868683969daa55287e2db6","observation_id":"e8f5fb39-df29-424a-a215-ab20e6bdcd34","resolution":{"observed_at":"2026-08-03T00:47:35.968722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-15T14:51:45.381843Z","title":"Arthur Conmy, Augustine N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03913","last_updated":"2026-08-04T16:40:48Z","snapshot_observed_at":"2026-08-19T04:10:11.678124Z","submitted_at":"2026-08-04T16:40:48Z","title":"Sparse Weight Decomposition for Efficient Circuit Extraction","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-15T14:51:45.381843Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2608.03913"},"observation_digest":"sha256:8615ad3c65bcd79a7e455aa25584e3020556320471dcb1a98c473bd29bc65236","observation_id":"5066514a-4879-41ff-a1c2-117d1a2d8566","resolution":{"observed_at":"2026-08-15T14:51:45.381843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14997","snapshot_observed_at":"2026-08-14T13:29:00.101336Z","title":"Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga-Alonso","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13337","last_updated":"2026-08-13T15:06:56Z","snapshot_observed_at":"2026-08-19T08:41:50.325589Z","submitted_at":"2026-08-13T15:06:56Z","title":"Where You Measure Decides What You Measure: Position Selection in Ablation-Based SAE Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T13:29:00.101336Z"},"links":{"cited_paper":"/paper/2304.14997","citing_paper":"/paper/2608.13337"},"observation_digest":"sha256:c9d33bb2082dec6f6f00907d49ea178b4ef222dc6a7895b4b2f0669495f0f098","observation_id":"5daefd8d-c7e4-4f95-be1a-2feb7a3718c2","resolution":{"observed_at":"2026-08-14T13:29:00.101336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2304.14997/citation-record","integrity":"/paper/2304.14997/integrity","json":"/paper/2304.14997/citation-record.json","paper":"/paper/2304.14997"},"outbound":[],"paper":{"arxiv_id":"2304.14997","last_updated":"2023-10-28T20:05:52Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T12:58:16.258648Z","submitted_at":"2023-04-28T17:36:53Z","title":"Towards Automated Circuit Discovery for Mechanistic Interpretability"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 40 inbound Pith citation observations for arXiv:2304.14997."}