{"as_of":"2026-08-10T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aee8d60dfcdda64405ad5bf58c88eb93ed65e9f03ae2d2a60e115793d7ace7ae","coverage":[{"denominator":104,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:08:49.522940Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T16:38:10.113987Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T16:44:56.182451Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"cited_work":{"arxiv_id":"2501.18887","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18887","snapshot_observed_at":"2026-06-30T16:44:56.182451Z","title":"Towards Unified Attri- bution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","venue":null,"work_id":"1ccf2f7d-5524-40c5-bddc-c31b6dc74ca4","year":2025},"citing_paper":{"arxiv_id":"2605.23080","last_updated":"2026-06-01T07:17:20Z","snapshot_observed_at":"2026-08-06T20:39:36.338304Z","submitted_at":"2026-05-21T22:27:04Z","title":"The Attribution Contract: Feature Attribution for Generative Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T05:31:09.737172Z"},"links":{"cited_paper":"/paper/2501.18887","citing_paper":"/paper/2605.23080"},"observation_digest":"sha256:6929f92fc6f896458fd8442485b82b28a9abde06f3a39649a924c0dabe64685d","observation_id":"db3359b2-42be-4de6-b42e-049b6ac1225e","resolution":{"observed_at":"2026-05-25T05:36:40.462650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"cited_work":{"arxiv_id":"2501.18887","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18887","snapshot_observed_at":"2026-06-30T16:44:56.182451Z","title":"Towards Unified Attri- bution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","venue":null,"work_id":"1ccf2f7d-5524-40c5-bddc-c31b6dc74ca4","year":2025},"citing_paper":{"arxiv_id":"2605.23080","last_updated":"2026-06-01T07:17:20Z","snapshot_observed_at":"2026-08-06T20:39:36.338304Z","submitted_at":"2026-05-21T22:27:04Z","title":"The Attribution Contract: Feature Attribution for Generative Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T16:38:10.113987Z"},"links":{"cited_paper":"/paper/2501.18887","citing_paper":"/paper/2605.23080"},"observation_digest":"sha256:ab7bb188bb52310c50c6c0d7a24ab86ff0f359cfe178ca61025a63e9473a6eec","observation_id":"1fcdbcff-2277-4c5c-a05b-79100de73986","resolution":{"observed_at":"2026-06-30T16:44:56.183851Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.18887/citation-record","integrity":"/paper/2501.18887/integrity","json":"/paper/2501.18887/citation-record.json","paper":"/paper/2501.18887"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:47.904086Z","title":"Sanity checks for saliency maps","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.904086Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:8ae6af0c45a94a0c67000d149271b74acb7b2d6c96bcfb36f042b6d4dddff414","observation_id":"544aad39-f27f-4c58-af16-8797f6c5e360","resolution":{"observed_at":"2026-08-09T22:08:47.904086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08025","last_updated":"2025-04-01T14:16:47Z","snapshot_observed_at":"2026-07-06T19:31:13.821669Z","submitted_at":"2024-10-10T15:22:48Z","title":"The Computational Complexity of Circuit Discovery for Inner Interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08025","snapshot_observed_at":"2026-08-09T22:08:47.946408Z","title":"The computational complexity of circuit discovery for inner interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.946408Z"},"links":{"cited_paper":"/paper/2410.08025","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:26e73de5395ca6a3bedc50a7c4a68d74c9461d67a46a6bd994e1ea83bb26fbd8","observation_id":"ab7d45d5-d250-46c1-9d66-8e0aba5f0d49","resolution":{"observed_at":"2026-08-09T22:08:47.946408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:47.952471Z","title":"Openxai: Towards a transparent evaluation of model explanations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.952471Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:602638fcf13d324afcc6a1cf8c6ad6c010c00186344172eb3a4b9efe8acb4b38","observation_id":"a3aff9eb-7ca1-4876-aca2-b0b7bac39b1f","resolution":{"observed_at":"2026-08-09T22:08:47.952471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:47.957435Z","title":"Towards the unification and robustness of perturbation and gradient based explanations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.957435Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:472a124f55e621de3f78f5abf6be5065eaf199879d2375e52314d2b4153194b6","observation_id":"e4c53994-a7e6-4737-81d3-186ab98d3316","resolution":{"observed_at":"2026-08-09T22:08:47.957435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.06104","last_updated":"2018-03-07T10:49:28Z","snapshot_observed_at":"2026-07-06T06:09:50.743518Z","submitted_at":"2017-11-16T14:19:29Z","title":"Towards better understanding of gradient-based attribution methods for Deep Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.06104","snapshot_observed_at":"2026-08-09T22:08:47.962165Z","title":"A unified view of gradient-based attribution methods for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.962165Z"},"links":{"cited_paper":"/paper/1711.06104","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:9e9a80cd76717dde8096c73809233f312fc8000a551cfae95c171a376903091f","observation_id":"dc7ffa4c-0b36-4987-96d6-ce18928a53f0","resolution":{"observed_at":"2026-08-09T22:08:47.962165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:47.966761Z","title":"Explainable artificial intelligence (xai): Concepts, taxonomies, opportunities and challenges toward responsible ai","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:47.966761Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:9d6be5125a4ac65f25250ca5988210f268e54921d84db4f7ff6b6f1fc5bfbeef","observation_id":"a3f5b8e0-cbc1-4c08-b264-8c30b4ff6c1f","resolution":{"observed_at":"2026-08-09T22:08:47.966761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.044192Z","title":"On pixel-wise explanations for non-linear classifier decisions by layer-wise relevance propagation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.044192Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:463338623f75fe59bba920a3dcacf7e74b3d12390f46fb333c19dafe997156ee","observation_id":"4a4fc48e-13fc-4313-9226-d1270a3c3edd","resolution":{"observed_at":"2026-08-09T22:08:48.044192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.102477Z","title":"Training data attribution via approximate unrolling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.102477Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:8305cc727f60286e8df9d7c9b9cd0328094bf28cd471538dd55ff93be77ae38a","observation_id":"417576fd-f07f-49f4-a45d-354c6731f73d","resolution":{"observed_at":"2026-08-09T22:08:48.102477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.106326Z","title":"How to explain individual classification decisions","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.106326Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:2b60d349fc8d787930eb1c7c438f1f26b18bb7464a514301d60c6ad42614d708","observation_id":"d18eb3fc-9155-4f10-ae5d-f7aada9d6ff5","resolution":{"observed_at":"2026-08-09T22:08:48.106326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.110590Z","title":"Model interpretability through the lens of computational complexity","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.110590Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:81d54174cb4197f1abae911df2614819f397254d8e5908b1f56316543c687a3d","observation_id":"93e65556-e7f7-4d60-a239-5b395f219326","resolution":{"observed_at":"2026-08-09T22:08:48.110590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.115499Z","title":"Relatif: Identifying explanatory training samples via relative influence","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.115499Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:151b603f3f54924ee36cd1705723b74be85a2c7c582aaa79bfb100a5e9f77134","observation_id":"6ff17719-6853-4596-9dac-2b85015ab196","resolution":{"observed_at":"2026-08-09T22:08:48.115499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02981","last_updated":"2024-06-07T08:44:52Z","snapshot_observed_at":"2026-07-06T18:25:40.229186Z","submitted_at":"2024-06-05T06:23:49Z","title":"Local vs. Global Interpretability: A Computational Complexity Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02981","snapshot_observed_at":"2026-08-09T22:08:48.119469Z","title":"Local vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.119469Z"},"links":{"cited_paper":"/paper/2406.02981","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b1342e2fb287c370771a4ae97ca274b81aa64622612441c429e5818402292b8e","observation_id":"bc3b1fb1-b7be-4b80-9304-8e4213366f0e","resolution":{"observed_at":"2026-08-09T22:08:48.119469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.160962Z","title":"Understanding the role of individual units in a deep neural network","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.160962Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b13bace3c04d8e93b2028fa0d947cac45b38fa93c9d48656856a8427739a5e76","observation_id":"598cc04f-c536-46f7-9f43-a0552a65bfd2","resolution":{"observed_at":"2026-08-09T22:08:48.160962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-09T22:08:48.215353Z","title":"Mechanistic interpretability for ai safety--a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.215353Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:a72a6a63adf6483cef2587d07ee4059085651caf1785b93daae897d59f7911e0","observation_id":"b40a6910-6d24-4046-9905-18dbfcbdc605","resolution":{"observed_at":"2026-08-09T22:08:48.215353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.316025Z","title":"Impossibility theorems for feature attribution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.316025Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5398e64b479c4bb0a6dc26b4ea8a1f8d861ff6fab66eede155b5948742b7bf2c","observation_id":"3d48b45e-df0b-4253-aa88-65a5edef6969","resolution":{"observed_at":"2026-08-09T22:08:48.316025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.319671Z","title":"From shapley values to generalized additive models and back","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.319671Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:fbd2023476f288f8eb32a0e6c048f25283d78c0d184490ce028ae897989dab16","observation_id":"324fb49f-6167-48cf-ba57-5a4313f7f2b7","resolution":{"observed_at":"2026-08-09T22:08:48.319671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.323382Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.323382Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:728a8b7723b1d41ba42a20867174657a29ae58f3d7a9bbd08325960c025a4da1","observation_id":"d36010b5-cbe7-40e4-9fb7-ec6f749bc610","resolution":{"observed_at":"2026-08-09T22:08:48.323382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.328220Z","title":"Truth is universal: Robust detection of lies in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.328220Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:27b76be95bfa9935f3a46e4d10fca44e18ae14c6d90fbca6150ed20ccedce63a","observation_id":"4161a736-ee2e-45d4-a6cb-2240ec3a2323","resolution":{"observed_at":"2026-08-09T22:08:48.328220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03514","last_updated":"2021-04-08T05:11:21Z","snapshot_observed_at":"2026-08-06T09:36:53.061945Z","submitted_at":"2021-04-08T05:11:21Z","title":"Low-Complexity Probing via Finding Subnetworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.03514","snapshot_observed_at":"2026-08-09T22:08:48.372194Z","title":"Low-complexity probing via finding subnetworks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.372194Z"},"links":{"cited_paper":"/paper/2104.03514","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5c8fdd42d8b92dc5c095c14861f9ad8bf838c82fc6af67b4e041ae5118f56f43","observation_id":"a3957521-c2a9-49bf-bd59-609e85985399","resolution":{"observed_at":"2026-08-09T22:08:48.372194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07840","last_updated":"2024-10-03T17:56:12Z","snapshot_observed_at":"2026-07-06T17:58:56.081219Z","submitted_at":"2024-04-11T15:27:56Z","title":"On Training Data Influence of GPT Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07840","snapshot_observed_at":"2026-08-09T22:08:48.421948Z","title":"On training data influence of gpt models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.421948Z"},"links":{"cited_paper":"/paper/2404.07840","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0d422247efdb3f6725523cb3824fcb9a030a77bc018df2f5d6ebcf36c1ad0021","observation_id":"4aab51a0-159a-40e5-a4ca-1f1588fd8751","resolution":{"observed_at":"2026-08-09T22:08:48.421948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.426725Z","title":"Input similarity from the neural network perspective","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.426725Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5f85c77772ef872dfedcfd2b1a42fd5acce1aa7957c972128443c6978c11950a","observation_id":"e591948d-725c-4d86-bd42-8ff0885d6ddc","resolution":{"observed_at":"2026-08-09T22:08:48.426725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.431068Z","title":"Learning to explain: An information-theoretic perspective on model interpretation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.431068Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:e0ba155dba80b58c9be88baffad3f570780be86da159c3c5666cf6b30d726ba4","observation_id":"496bef55-fbd4-4f4a-9a6e-180802a79487","resolution":{"observed_at":"2026-08-09T22:08:48.431068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.02610","last_updated":"2018-08-08T03:10:24Z","snapshot_observed_at":"2026-07-06T06:54:36.479415Z","submitted_at":"2018-08-08T03:10:24Z","title":"L-Shapley and C-Shapley: Efficient Model Interpretation for Structured Data","version":1},"cited_work":{"arxiv_id":"1808.02610","doi":null,"metadata_source":"pith","pith_arxiv_id":"1808.02610","snapshot_observed_at":"2026-08-09T22:08:50.062410Z","title":"L-Shapley and C-Shapley: Efficient Model Interpretation for Structured Data","venue":"cs.LG","work_id":"00d23239-bc42-4685-99ab-c87a9e9e3687","year":2018},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.435459Z"},"links":{"cited_paper":"/paper/1808.02610","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:a8c50a9635f492a6db8126399bab983fe922e453ab095f1be4dc2296bda851c9","observation_id":"b071a38e-e8e2-46c9-9b78-c7a47acae46f","resolution":{"observed_at":"2026-08-09T22:08:50.117270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.448408Z","title":"Towards automated circuit discovery for mechanistic interpretability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.448408Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:47ed96ffa8cde8e2b8d099d09527a3243c27a045bcf2de07733e5bf531d2f39e","observation_id":"fc82c27a-5455-4646-b73d-84a81b707c94","resolution":{"observed_at":"2026-08-09T22:08:48.448408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.496268Z","title":"Detection of influential observation in linear regression","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.496268Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b2ba51c1d3614230506bf6bd1c365364cdce4b05da1a0d51f823577d6bc4d041","observation_id":"4089653a-5221-46b1-867b-c47531a9b57f","resolution":{"observed_at":"2026-08-09T22:08:48.496268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.500793Z","title":"Characterizations of an empirical influence function for detecting influential cases in regression","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.500793Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:6c6a1ea712be5c5e34bb7346a54e0a2aec14ed60a39fb6149f0734b211ef2a00","observation_id":"4fd4a1b0-1f88-4cfa-ad54-55377927c584","resolution":{"observed_at":"2026-08-09T22:08:48.500793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.505144Z","title":"Residuals and influence in regression","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.505144Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:173796896a9a875355f138188f907ceb81c5cec6add978f4554251b985709962","observation_id":"dcf38d66-40ad-4ddd-99b5-b754d61b7250","resolution":{"observed_at":"2026-08-09T22:08:48.505144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.509044Z","title":"Explaining by removing: A unified framework for model explanation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.509044Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:7b27aa06b11d68dadb08e2adcd670c7eee7e49bc2626424878956757b9b8615b","observation_id":"7e635e98-62bf-4d84-b61c-17989164edc4","resolution":{"observed_at":"2026-08-09T22:08:48.509044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02066","last_updated":"2021-03-06T17:35:13Z","snapshot_observed_at":"2026-08-07T17:33:52.595773Z","submitted_at":"2020-10-05T15:04:11Z","title":"Are Neural Nets Modular? Inspecting Functional Modularity Through Differentiable Weight Masks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02066","snapshot_observed_at":"2026-08-09T22:08:48.512966Z","title":"Are neural nets modular? inspecting functional modularity through differentiable weight masks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.512966Z"},"links":{"cited_paper":"/paper/2010.02066","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:91156d366fa1ebb6963d03d86dc18a2e7fa9e1ccb759f1406ec66d2cf57d32dc","observation_id":"64130377-6b92-4da4-96e5-08086e9abd8c","resolution":{"observed_at":"2026-08-09T22:08:48.512966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-09T22:08:48.577199Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.577199Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:41c19e0513ee20004a274177f964a640f0f9deb887e287f7cc3cee18256cabf7","observation_id":"83d02947-ffdb-417f-a979-7a845d7390ae","resolution":{"observed_at":"2026-08-09T22:08:48.577199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.647885Z","title":"Real time image saliency for black box classifiers","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.647885Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:bab937743fe66ec7f5d7904ad72b777f1798fbe93ab9c81a1ae285e00543c28e","observation_id":"0d5db427-3cc5-461a-9349-4851b35b38e6","resolution":{"observed_at":"2026-08-09T22:08:48.647885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08164","last_updated":"2021-09-08T20:44:44Z","snapshot_observed_at":"2026-08-07T07:18:37.623241Z","submitted_at":"2021-04-16T15:24:42Z","title":"Editing Factual Knowledge in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08164","snapshot_observed_at":"2026-08-09T22:08:48.651857Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.651857Z"},"links":{"cited_paper":"/paper/2104.08164","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:7e2c884066db4a2add0fc1bc48673392e595a0ac81a6cd57b3baa22d6c14941c","observation_id":"d74bc7cd-ea63-4263-9d8f-7481434e7c49","resolution":{"observed_at":"2026-08-09T22:08:48.651857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.05622","last_updated":"2020-02-07T19:09:02Z","snapshot_observed_at":"2026-07-06T07:33:14.746841Z","submitted_at":"2019-02-14T22:09:49Z","title":"The Shapley Taylor Interaction Index","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.05622","snapshot_observed_at":"2026-08-09T22:08:48.656309Z","title":"The shapley taylor interaction index","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.656309Z"},"links":{"cited_paper":"/paper/1902.05622","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:6304ce31c325c0a94c6c3dd4935032860a6f67b204f7988f918135530a1e223f","observation_id":"2db03886-cee7-4492-98e2-eaab3b8cd089","resolution":{"observed_at":"2026-08-09T22:08:48.656309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.681601Z","title":"Visualizing higher-layer features of a deep network","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.681601Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:16a222feb23f60dee6ec12830ee3b6f269313b96f273072fc9027d91dd4289ac","observation_id":"2f063110-4912-4d73-85f9-2240005586f9","resolution":{"observed_at":"2026-08-09T22:08:48.681601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.793950Z","title":"Interpretable explanations of black boxes by meaningful perturbation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.793950Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:81adb43c2643fe1c6cee033ff91679049f5c2949935e6d208e2fdb8f17228eb7","observation_id":"1d7199f1-c8ad-4e98-9270-655e9f09a203","resolution":{"observed_at":"2026-08-09T22:08:48.793950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.847796Z","title":"Causal abstractions of neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.847796Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:319e782674d7fe2766e13d89af557bdcf3690e84f1bd742f44ff2db033fbff10","observation_id":"10f53722-7067-4003-968e-5ef86d950594","resolution":{"observed_at":"2026-08-09T22:08:48.847796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14767","last_updated":"2023-10-13T19:01:20Z","snapshot_observed_at":"2026-08-08T04:09:02.821651Z","submitted_at":"2023-04-28T11:26:17Z","title":"Dissecting Recall of Factual Associations in Auto-Regressive Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14767","snapshot_observed_at":"2026-08-09T22:08:48.851822Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.851822Z"},"links":{"cited_paper":"/paper/2304.14767","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:c99c33e489da43b815f5e5c6bf4a4a93a67c456504383d9fa3871b234dc98075","observation_id":"151968d1-fa5e-4fd4-b7b1-6770137f1c39","resolution":{"observed_at":"2026-08-09T22:08:48.851822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06102","last_updated":"2024-06-06T22:59:58Z","snapshot_observed_at":"2026-08-10T02:14:16.642058Z","submitted_at":"2024-01-11T18:33:48Z","title":"Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06102","snapshot_observed_at":"2026-08-09T22:08:48.855623Z","title":"Patchscope: A unifying framework for inspecting hidden representations of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.855623Z"},"links":{"cited_paper":"/paper/2401.06102","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f79084db35e95d0fed29b046911106efc1e345c18959821269dac30d60e87441","observation_id":"dbafd31b-d2bc-42fc-97b6-b7d70cc9df07","resolution":{"observed_at":"2026-08-09T22:08:48.855623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.860387Z","title":"Data shapley: Equitable valuation of data for machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.860387Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:cb03ca53cf3cad8d001345391588c40999dedb1fa6311bc8f80860f36c758e74","observation_id":"7a89b43e-4a66-434a-a64a-c4b01378500f","resolution":{"observed_at":"2026-08-09T22:08:48.860387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.673973Z","title":"Neuron shapley: Discovering the responsible neurons","venue":null,"work_id":"deab1645-acc2-47b1-9dbb-d6039ea79526","year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.864164Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:4a913571391b2ac4027f47befc86ba038548aa09d865070b676de01c8789b8f2","observation_id":"d6b9c795-a9db-435a-bbcc-95e6d7b9f195","resolution":{"observed_at":"2026-08-09T22:08:51.677273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-09T11:08:40.708986Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-09T22:08:48.945695Z","title":"Studying large language model generalization with influence functions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.945695Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0c70172778acb1fef1b4ea8890571dd3a6983582177ee69c535248a953b411f4","observation_id":"c00892aa-7356-4fa3-87cb-b3c71cc49d49","resolution":{"observed_at":"2026-08-09T22:08:48.945695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01933","last_updated":"2018-06-21T08:15:38Z","snapshot_observed_at":"2026-07-06T06:21:58.257426Z","submitted_at":"2018-02-06T13:20:02Z","title":"A Survey Of Methods For Explaining Black Box Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01933","snapshot_observed_at":"2026-08-09T22:08:48.954165Z","title":"A survey of methods for explaining black box models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.954165Z"},"links":{"cited_paper":"/paper/1802.01933","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:7632842bc766f5a299181f9c2a441bf386af58c4cb749f452659274173e1a772","observation_id":"7bc86378-b9e5-4c53-b170-400bd6998688","resolution":{"observed_at":"2026-08-09T22:08:48.954165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:48.958458Z","title":"F ast IF : Scalable influence functions for efficient model interpretation and debugging","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.958458Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:846ba13ec19a66e8d7b84ae7bc96f10a238ddb202f98394350746656c7699c4f","observation_id":"4b381eaa-879e-4291-8286-02ea2af4306e","resolution":{"observed_at":"2026-08-09T22:08:48.958458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.663734Z","title":"Training data influence analysis and estimation: A survey","venue":null,"work_id":"8cfadd8a-2fcc-41f4-b5b5-a7cebe3b9ecb","year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.962263Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:52bf582e2165367e0e9fa5ee2611ff6ab404dd19f1c0a6246818cdc4eb0397a9","observation_id":"97f5ea7b-b31c-4ba8-8153-066db554e959","resolution":{"observed_at":"2026-08-09T22:08:51.667856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.533420Z","title":"Which explanation should i choose? a function approximation perspective to characterizing post hoc explanations","venue":null,"work_id":"7fe8a1de-4028-4ee2-af8f-ef3e6641e225","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.966200Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:9b21a50b0680a71d0d2f14b6f9553094534fba1bc719a0ac7de8f363bad948bc","observation_id":"114c8d32-7649-4347-afd7-e424f3306f61","resolution":{"observed_at":"2026-08-09T22:08:51.611010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.487253Z","title":"Data cleansing for models trained with sgd","venue":null,"work_id":"e21f737e-53aa-4b57-a471-53d6bdc47fff","year":2019},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.987488Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:ff396e4a78ecced7f267e0d21dc1f10de006aad303a084afa20fcaed817cb088","observation_id":"54dc25be-70c4-4909-9ee9-1247bd1dd823","resolution":{"observed_at":"2026-08-09T22:08:51.516198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.429030Z","title":"Does localization inform editing? surprising differences in causality-based localization vs","venue":null,"work_id":"d7fe5f4f-362e-4cb5-b36a-e4503d032d8c","year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:48.998446Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0c32d193d57c3ba3ef04980ac641b51a2525e8ad410caf13c7ce9e25299b0138","observation_id":"a907d9c6-f482-4fa1-bb00-901fcf77ffd5","resolution":{"observed_at":"2026-08-09T22:08:51.433270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.418072Z","title":"Significance tests for neural networks","venue":null,"work_id":"4febed16-ac4d-47bf-b253-1dd88ef8fb4f","year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.002004Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:06c28a5e6e91ae98785722b2743d413ba2b62c44c48c7737557c64fa9bbb2359","observation_id":"53454b65-cc7c-45c8-a715-6648abaf276f","resolution":{"observed_at":"2026-08-09T22:08:51.421819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.370638Z","title":"Computationally efficient feature significance and importance for predictive models","venue":null,"work_id":"04a9b2b6-2c75-45b7-a50a-ca48034685be","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.005647Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:aa81af42be2b3f3c0232d8a6d08355961be81dedc600776fe5af45063a5f8a2b","observation_id":"03f3aab9-a896-48bc-a5bc-ff00a43ca432","resolution":{"observed_at":"2026-08-09T22:08:51.410738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00622","last_updated":"2022-02-01T18:15:24Z","snapshot_observed_at":"2026-08-09T04:57:14.602603Z","submitted_at":"2022-02-01T18:15:24Z","title":"Datamodels: Predicting Predictions from Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00622","snapshot_observed_at":"2026-08-09T22:08:49.009215Z","title":"Datamodels: Predicting predictions from training data","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.009215Z"},"links":{"cited_paper":"/paper/2202.00622","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:c71b61227853fcf2802c25bbbf181fd99a7e3e08af1b58b03485cfe6339cde83","observation_id":"63acd2b8-7fcd-457c-8a0a-09d84f4d168a","resolution":{"observed_at":"2026-08-09T22:08:49.009215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.344896Z","title":"Explaining explanations: Axiomatic feature interactions for deep networks","venue":null,"work_id":"8724ca7f-1ee4-4b6a-9fef-1a64681eb8df","year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.012620Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:1488f512a0f1a69ff9082538ab07dda1580b86d84892f4e0a0420726fc33638e","observation_id":"2ab0420f-2ffe-4c55-8f36-3445db1361d8","resolution":{"observed_at":"2026-08-09T22:08:51.356375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.333459Z","title":"How can i explain this to you? an empirical study of deep neural network explanation methods","venue":null,"work_id":"4026dc29-0390-4176-93da-2ca2fdc055d4","year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.015745Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:1a3ee28003147015575ea4fb8a84fc4469992b7792e4626434769e96dbdd25ec","observation_id":"d5cfefe2-d3c5-4476-800c-e4c132e50293","resolution":{"observed_at":"2026-08-09T22:08:51.337554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.08619","last_updated":"2020-03-29T06:05:56Z","snapshot_observed_at":"2026-08-09T21:57:07.776836Z","submitted_at":"2019-08-22T23:09:27Z","title":"Efficient Task-Specific Data Valuation for Nearest Neighbor Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.08619","snapshot_observed_at":"2026-08-09T22:08:49.037174Z","title":"Efficient task-specific data valuation for nearest neighbor algorithms","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.037174Z"},"links":{"cited_paper":"/paper/1908.08619","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:9c81dce8fa1b009f3e6039ae79633e5b4bbdb04d235f293e86f1aa3d5128b837","observation_id":"b5b51c3e-fcea-4152-9c5e-cab117ac5baa","resolution":{"observed_at":"2026-08-09T22:08:49.037174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.228743Z","title":"Scalability vs","venue":null,"work_id":"dc325a40-8c8b-40ff-8cc8-3cc78b19fc05","year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.047934Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:32cafb6ab8de94d708907e52c54ce775e0eb9f0797694cfed9d0ef58164abed8","observation_id":"6a58a12f-93ef-4920-b35d-a93d5722be36","resolution":{"observed_at":"2026-08-09T22:08:51.274256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.052366Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.052366Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:cc56a9dddc61c5d4d865000e77f93d70844a087cc78edbe9d210574f993f4857","observation_id":"2d85436c-3c2c-42f6-af98-05cf24df872a","resolution":{"observed_at":"2026-08-09T22:08:49.052366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.055793Z","title":"Concept bottleneck models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.055793Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:1fce5d9c99ec8c62c5d17ccc634ef5e1487aaf84e4a6771646c02042ffaa6450","observation_id":"20ec30a9-b459-49c0-ba58-85c07fac85be","resolution":{"observed_at":"2026-08-09T22:08:49.055793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.128219Z","title":"The disagreement problem in explainable machine learning: A practitioner's perspective","venue":null,"work_id":"26dde15a-4a5b-4eb2-86b8-9acfb1307aea","year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.059151Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:7427987fd1b7174f04ec0efec2eb09a1469301d54b5c82c1f56a8a696559e085","observation_id":"fe244f07-135f-47b4-b066-8c01afafec66","resolution":{"observed_at":"2026-08-09T22:08:51.183366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.097259Z","title":"Beta shapley: a unified and noise-reduced data valuation framework for machine learning","venue":null,"work_id":"e9ff0daa-814a-46f4-a853-ba639a9e7f97","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.063245Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f3c305c25b6b5bbcd97280545e0587748914a070a3c555300df860e032a58559","observation_id":"5ddc95a8-aeb1-4ffb-85b2-625891c1b109","resolution":{"observed_at":"2026-08-09T22:08:51.102080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09951","last_updated":"2024-09-16T02:45:54Z","snapshot_observed_at":"2026-07-06T19:15:47.493514Z","submitted_at":"2024-09-16T02:45:54Z","title":"Optimal ablation for interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09951","snapshot_observed_at":"2026-08-09T22:08:49.066626Z","title":"Optimal ablation for interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.066626Z"},"links":{"cited_paper":"/paper/2409.09951","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b364704d10d0bd75c83ebedd27b8ab839a6754f08fc6855dfd80cba3e63cf252","observation_id":"d8b1eb33-9256-449e-9a0f-46cc3641ec89","resolution":{"observed_at":"2026-08-09T22:08:49.066626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:51.014593Z","title":"Measuring the effect of training data on deep learning predictions via randomized experiments","venue":null,"work_id":"1e8d5e8c-807c-4601-90fb-576ec7d38bc9","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.090949Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:882c75766e148353e34293c93661419f495755df5c954812469e252f88af0e0c","observation_id":"32a32703-04f1-4bf3-a956-666404260c6b","resolution":{"observed_at":"2026-08-09T22:08:51.068388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.988821Z","title":"A unified approach to interpreting model predictions","venue":null,"work_id":"78b093c1-5bf3-402a-b623-7905b354f6e7","year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.103417Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0d41d01ef674c178955de61d39856d38f69f3e776ceadc845e9ed82c44298a9c","observation_id":"17516acd-d6a6-42bc-a75a-0226d9980096","resolution":{"observed_at":"2026-08-09T22:08:50.993243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-09T22:08:49.106869Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.106869Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5e314ca38af3a556a2cacfed5f6d39ea24189174cc1836dc22a526d7d5a66547","observation_id":"d72ea797-a2bb-465d-9a79-2696a5052349","resolution":{"observed_at":"2026-08-09T22:08:49.106869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-09T22:08:49.111250Z","title":"Sparse feature circuits: Discovering and editing interpretable causal graphs in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.111250Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:38977e41768cca7b960add19f3817615b413c24fdc111c7c27f19525dea3a11b","observation_id":"f0a95d27-cce8-4228-a332-2c5c2d666273","resolution":{"observed_at":"2026-08-09T22:08:49.111250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.115466Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.115466Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f4683d5e3c76610358321256bc35316da922f85979496c5a3277eea37038536b","observation_id":"32cc5a54-d5ae-41b0-a3fb-661a8a4747dd","resolution":{"observed_at":"2026-08-09T22:08:49.115466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.870484Z","title":"Coresets for data-efficient training of machine learning models","venue":null,"work_id":"132da127-2736-4ccd-8b38-07f45c652f4d","year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.119187Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f7ca0d2951865d10cb9989cab13935966fd28f8eb74bca4f367f9eb3385aefa5","observation_id":"0a266f8c-3f42-41d2-880a-97a0fba9c8fc","resolution":{"observed_at":"2026-08-09T22:08:50.906908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.11309","last_updated":"2022-06-13T23:26:16Z","snapshot_observed_at":"2026-08-03T23:42:31.942314Z","submitted_at":"2021-10-21T17:41:56Z","title":"Fast Model Editing at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.11309","snapshot_observed_at":"2026-08-09T22:08:49.139911Z","title":"Fast model editing at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.139911Z"},"links":{"cited_paper":"/paper/2110.11309","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:83ff9c8fe44b1970cf2fe8858d6def4993d91e71999b77fcdfd0a6538637b3c7","observation_id":"b47d2276-3447-4c87-80de-7103df7efa6a","resolution":{"observed_at":"2026-08-09T22:08:49.139911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.154911Z","title":"The quest for the right mediator: A history, survey, and theoretical grounding of causal interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.154911Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:63f788ec31bba43fa4d8dc35c500b97aefde86c9df102d2c0954d5512d4fd95a","observation_id":"73d1328c-0dcd-4728-ba32-7d692be367bb","resolution":{"observed_at":"2026-08-09T22:08:49.154911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.173053Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.173053Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:2d6a6367e6e24b9aae383e00b610e8292424db2bebc987cce98a0dc035da2ce5","observation_id":"06ba1049-f2e1-4da9-bdcf-829151111829","resolution":{"observed_at":"2026-08-09T22:08:49.173053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08689","last_updated":"2024-07-11T17:28:07Z","snapshot_observed_at":"2026-07-06T18:44:57.578408Z","submitted_at":"2024-07-11T17:28:07Z","title":"Operationalizing the Blueprint for an AI Bill of Rights: Recommendations for Practitioners, Researchers, and Policy Makers","version":1},"cited_work":{"arxiv_id":"2407.08689","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08689","snapshot_observed_at":"2026-08-09T22:08:49.831583Z","title":"Operationalizing the Blueprint for an AI Bill of Rights: Recommendations for Practitioners, Researchers, and Policy Makers","venue":"cs.AI","work_id":"e65a0f14-00e6-4be5-ae0f-85742485fa20","year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.176621Z"},"links":{"cited_paper":"/paper/2407.08689","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:6938c6eaa75d87ab86984f261d15c1664f6b405547467926c19eb2dd2bccdcb8","observation_id":"f055dfeb-04f4-4d27-980e-2f69c13f3257","resolution":{"observed_at":"2026-08-09T22:08:49.857272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-09T22:08:49.180582Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.180582Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:e4d8eb9557fafc27a91211316e9e0d9a510ecffaa6df0f5dff9a322c7cb6e612","observation_id":"1415e7b3-335f-4184-acca-52e1657e1b7d","resolution":{"observed_at":"2026-08-09T22:08:49.180582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14186","last_updated":"2023-04-03T17:37:50Z","snapshot_observed_at":"2026-08-07T22:49:29.096522Z","submitted_at":"2023-03-24T17:56:22Z","title":"TRAK: Attributing Model Behavior at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14186","snapshot_observed_at":"2026-08-09T22:08:49.185185Z","title":"Trak: Attributing model behavior at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.185185Z"},"links":{"cited_paper":"/paper/2303.14186","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0960be00540697ff8232fe3df560a558d791c55ce951151096b0eb5a895b1f48","observation_id":"40adbb1e-0849-40b9-82b6-e6465ec59578","resolution":{"observed_at":"2026-08-09T22:08:49.185185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.854212Z","title":"High dimensional model explanations: An axiomatic approach","venue":null,"work_id":"47347d2d-84af-482e-91b9-1de19657e806","year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.188825Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:28d1b6182e34763ef47912b38c4e0909dbdf5e6f3e5429b41a2f29098f3a9a31","observation_id":"e38ee709-6934-4de3-9af2-e33c50b3589f","resolution":{"observed_at":"2026-08-09T22:08:50.858060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.750874Z","title":"Direct and indirect effects","venue":null,"work_id":"491caec3-fd22-4014-8345-0752189647b1","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.204067Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:e72596cb6083252eb4513973f66f47339b80e4f54bf6cbba35ac7cf7029c37c0","observation_id":"976d8773-0fbb-4931-b39f-c7e55e0e7b5b","resolution":{"observed_at":"2026-08-09T22:08:50.802985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.07421","last_updated":"2018-09-25T18:16:18Z","snapshot_observed_at":"2026-07-06T06:45:42.492990Z","submitted_at":"2018-06-19T18:41:30Z","title":"RISE: Randomized Input Sampling for Explanation of Black-box Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.07421","snapshot_observed_at":"2026-08-09T22:08:49.220117Z","title":"Rise: Randomized input sampling for explanation of black-box models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.220117Z"},"links":{"cited_paper":"/paper/1806.07421","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:46355913ce6e002a2770052357c62c28ff82a53cbaa83a64032b874561e6a25e","observation_id":"97055b44-58c8-4f66-aee5-0ea43c03e749","resolution":{"observed_at":"2026-08-09T22:08:49.220117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.224114Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.224114Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:63bb25f122f060d46d3731487ab1c5cfc8a878cbd062451b05b3ee925e1b079f","observation_id":"c65d0988-6d72-4e8f-b23b-556b52a95d7f","resolution":{"observed_at":"2026-08-09T22:08:49.224114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.228421Z","title":"A practical review of mechanistic interpretability for transformer-based language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.228421Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b7fe3dbf95da4349c157c017ff4dba60f9c19725d2cedc46071abd896fafede8","observation_id":"17a68ba0-c93f-4503-a920-5feadbf2ad05","resolution":{"observed_at":"2026-08-09T22:08:49.228421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.732555Z","title":"Toward transparent ai: A survey on interpreting the inner structures of deep neural networks","venue":null,"work_id":"bf458bd2-a582-48e6-b62c-8b8ce72e0d62","year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.232447Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:01098f91f61f8f29ad1933a75da617ba7fb2a9478e9a35135f3e67de05ba5082","observation_id":"46994c71-691a-4612-9084-d460c725e915","resolution":{"observed_at":"2026-08-09T22:08:50.736646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.619452Z","title":"Why should i trust you?: Explaining the predictions of any classifier","venue":null,"work_id":"5fa5abd3-6d7f-4c63-9745-0a15d140dd1d","year":2016},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.235848Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:64123953ca50d66e1f7211047f40fe6a24540cbd82ed3a7504c463f956a27b60","observation_id":"6b63bf09-2565-46ab-be5a-07330f758897","resolution":{"observed_at":"2026-08-09T22:08:50.694863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.239750Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.239750Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:28ce66ac1b782a1a0be76744dd681b163ca71a383bbb9cd38864e1fc4274bda2","observation_id":"13c7ed74-8e5c-4ce4-bdf9-470e554a2932","resolution":{"observed_at":"2026-08-09T22:08:49.239750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09087","last_updated":"2024-10-07T15:02:12Z","snapshot_observed_at":"2026-07-06T19:32:02.130965Z","submitted_at":"2024-10-07T15:02:12Z","title":"Mechanistic?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09087","snapshot_observed_at":"2026-08-09T22:08:49.263576Z","title":"Mechanistic? arXiv preprint arXiv:2410.09087, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.263576Z"},"links":{"cited_paper":"/paper/2410.09087","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:6e9939bb28476ee76218338da4b6b711e6f8f3ca75420d95e0b257c31202302c","observation_id":"8d687681-d124-455f-886e-9dd5cdbc9e35","resolution":{"observed_at":"2026-08-09T22:08:49.263576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.553468Z","title":"Scaling up influence functions","venue":null,"work_id":"8f31fa27-e4eb-478d-918d-c1eb82a4a377","year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.306106Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b3041e27849f9be76c5ad0d9b3261e674de1e753215549fa1866277d82491c05","observation_id":"a755d0bb-385f-4acc-9a03-b5a91c1c2368","resolution":{"observed_at":"2026-08-09T22:08:50.558070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.07450","last_updated":"2017-01-25T16:33:29Z","snapshot_observed_at":"2026-08-07T01:29:08.076157Z","submitted_at":"2016-11-22T18:34:36Z","title":"Grad-CAM: Why did you say that?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.07450","snapshot_observed_at":"2026-08-09T22:08:49.309786Z","title":"Grad-cam: Why did you say that? arXiv preprint arXiv:1611.07450, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.309786Z"},"links":{"cited_paper":"/paper/1611.07450","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:819fc88e0352bdfd68aed9084a90c10955525a3aa00f5853fd22325288021b69","observation_id":"af074070-22c2-40d0-9767-a6d5bfb209c6","resolution":{"observed_at":"2026-08-09T22:08:49.309786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11534","last_updated":"2024-04-17T16:28:08Z","snapshot_observed_at":"2026-07-31T03:55:20.270351Z","submitted_at":"2024-04-17T16:28:08Z","title":"Decomposing and Editing Predictions by Modeling Model Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11534","snapshot_observed_at":"2026-08-09T22:08:49.313642Z","title":"Decomposing and editing predictions by modeling model computation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.313642Z"},"links":{"cited_paper":"/paper/2404.11534","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:114e56a6396e72638130b1c7472cdcd0bf3d35f92caff41af5783920c3d07196","observation_id":"6f11d50d-d2be-48b5-9ab3-d5dd4a0f3e60","resolution":{"observed_at":"2026-08-09T22:08:49.313642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.541650Z","title":"A value for n-person games","venue":null,"work_id":"3d98c85c-0ee3-4939-8397-8e72739c2000","year":1953},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.359787Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:43ee73af0f333461f2546103ca1846298254a69ec11a5ba0d09b971d7d6ce054","observation_id":"45307d3c-a2cc-4035-a95e-ed232e39fd31","resolution":{"observed_at":"2026-08-09T22:08:50.546600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.397053Z","title":"Learning important features through propagating activation differences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.397053Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b15087f0992c16c4cac73e8792480fae16b3cb6e1859989b24a4051c3645b571","observation_id":"c02c07c7-e5fa-4a65-9b8c-606aafde6ef3","resolution":{"observed_at":"2026-08-09T22:08:49.397053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-07-06T03:31:30.452356Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-09T22:08:49.400861Z","title":"Deep inside convolutional networks: Visualising image classification models and saliency maps","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.400861Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5822172e586c923934acb17a83c480a29b3fe9710715080a7d9d36130a401a30","observation_id":"994fa5a2-3dc5-4619-a83d-abfbf4c3b7ed","resolution":{"observed_at":"2026-08-09T22:08:49.400861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03825","last_updated":"2017-06-12T19:53:30Z","snapshot_observed_at":"2026-07-06T05:46:32.599765Z","submitted_at":"2017-06-12T19:53:30Z","title":"SmoothGrad: removing noise by adding noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03825","snapshot_observed_at":"2026-08-09T22:08:49.405664Z","title":"Smoothgrad: removing noise by adding noise","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.405664Z"},"links":{"cited_paper":"/paper/1706.03825","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:2d719427eb52d6da0f1c7fe34ffcc77a3d0bad89bc004e361b007c8c82d4d005","observation_id":"4901470a-9ced-43f7-9ad6-e3721a382ab7","resolution":{"observed_at":"2026-08-09T22:08:49.405664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.476947Z","title":"Limetree: Interactively customisable explanations based on local surrogate multi-output regression trees","venue":null,"work_id":"8e7ba231-8f5d-419d-a0e5-bfa5540c1f41","year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.409684Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:11962f0376d3a2557e789f930c2303c1a5626609bf734f0573f8fe3249804cfe","observation_id":"cdadac4d-52ae-4880-95cc-16acd7ae7598","resolution":{"observed_at":"2026-08-09T22:08:50.526569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6806","last_updated":"2015-04-13T07:58:17Z","snapshot_observed_at":"2026-08-08T13:18:11.819437Z","submitted_at":"2014-12-21T16:16:37Z","title":"Striving for Simplicity: The All Convolutional Net","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6806","snapshot_observed_at":"2026-08-09T22:08:49.414186Z","title":"Striving for simplicity: The all convolutional net","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.414186Z"},"links":{"cited_paper":"/paper/1412.6806","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5f74cf284a8e8034feea5270f4740d068402e17edc50a9c74063de5c92b1e6d5","observation_id":"df081e17-d84c-4049-b28d-a32d0e7aeef3","resolution":{"observed_at":"2026-08-09T22:08:49.414186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-09T22:08:49.435160Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.435160Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f543cec021096a3f52c560dde6dae5976555ca630826da8b6ae60cb333152359","observation_id":"afadc2db-82f8-4a32-86a6-e5483ef76889","resolution":{"observed_at":"2026-08-09T22:08:49.435160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.444409Z","title":"The many shapley values for model explanation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.444409Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:a60f5f5284debfedf3f5b96a8efddfbbe13590e55cdfe65976b426e624072148","observation_id":"9c8d0583-64c1-4e61-8355-d5a3e72420e3","resolution":{"observed_at":"2026-08-09T22:08:49.444409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01365","last_updated":"2017-06-13T01:52:38Z","snapshot_observed_at":"2026-07-06T05:32:18.507883Z","submitted_at":"2017-03-04T00:18:49Z","title":"Axiomatic Attribution for Deep Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01365","snapshot_observed_at":"2026-08-09T22:08:49.448502Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.448502Z"},"links":{"cited_paper":"/paper/1703.01365","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:bdae208edf8df125620ef042e0ade7ce63b1ee84c91bad83fc25cc753066101c","observation_id":"eda48cbd-ccb1-4846-93e2-66e1384f88e8","resolution":{"observed_at":"2026-08-09T22:08:49.448502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10348","last_updated":"2023-11-20T11:31:16Z","snapshot_observed_at":"2026-08-08T10:46:20.465189Z","submitted_at":"2023-10-16T12:34:43Z","title":"Attribution Patching Outperforms Automated Circuit Discovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10348","snapshot_observed_at":"2026-08-09T22:08:49.452770Z","title":"Attribution patching outperforms automated circuit discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.452770Z"},"links":{"cited_paper":"/paper/2310.10348","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:5eb16f06c6790ddeaba424c18b7ad01b22b32b5ab1a89e15679e0307c5d7c069","observation_id":"7e924a17-0f8f-45ab-bc7d-a37a6652d349","resolution":{"observed_at":"2026-08-09T22:08:49.452770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.460318Z","title":"Bias and confidence in not quite large samples","venue":null,"work_id":"6c7c8daf-56a3-4bc3-a030-7280ad205631","year":1958},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.457421Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:f2f60a81d4f785dc3f6e899ba8fa82c7055e7a22c5e75d1695451ab6de1ac202","observation_id":"a6c5cad6-145a-475a-9875-d6e9e7b64c31","resolution":{"observed_at":"2026-08-09T22:08:50.464654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:49.461343Z","title":"Investigating gender bias in language models using causal mediation analysis","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.461343Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:b2692b8390011c9404693a8d35581c02688895db692339d36a42f12c6dc56f1f","observation_id":"86ce6516-dd97-4289-8181-b9c18dd16cc1","resolution":{"observed_at":"2026-08-09T22:08:49.461343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01352","last_updated":"2024-07-31T13:18:13Z","snapshot_observed_at":"2026-08-09T07:31:56.741468Z","submitted_at":"2024-06-03T14:16:56Z","title":"Position: An Inner Interpretability Framework for AI Inspired by Lessons from Cognitive Neuroscience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01352","snapshot_observed_at":"2026-08-09T22:08:49.479518Z","title":"Position: An inner interpretability framework for ai inspired by lessons from cognitive neuroscience","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.479518Z"},"links":{"cited_paper":"/paper/2406.01352","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:18c1a0f37838e704d2707623d3f5395c1ff1b2d9989ebbd2648cca1129af3e64","observation_id":"40c8db46-091a-44f9-a79e-514c8786c25a","resolution":{"observed_at":"2026-08-09T22:08:49.479518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.360828Z","title":"Data banzhaf: A robust data valuation framework for machine learning","venue":null,"work_id":"2bc880ca-90e7-4d36-b664-9e11d920c6aa","year":2023},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.503289Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:0e334f74e5886b63bc8b1ce598ce98cdf0d4508a2c9cacbe9b889685d1c69f4a","observation_id":"105cd658-36de-4f44-98a6-3687202a1ab8","resolution":{"observed_at":"2026-08-09T22:08:50.395228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-09T22:08:49.514280Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.514280Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:ff3fa829fd6627fe5514da8e0173ecb2ece2aaa0af982e19739e338b2a579f7c","observation_id":"6699a44f-329f-4556-90f4-bbebab7ace34","resolution":{"observed_at":"2026-08-09T22:08:49.514280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10415","last_updated":"2024-03-15T15:49:31Z","snapshot_observed_at":"2026-08-06T05:25:37.889561Z","submitted_at":"2024-03-15T15:49:31Z","title":"Gradient based Feature Attribution in Explainable AI: A Technical Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10415","snapshot_observed_at":"2026-08-09T22:08:49.518559Z","title":"Gradient based feature attribution in explainable ai: A technical review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.518559Z"},"links":{"cited_paper":"/paper/2403.10415","citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:cd9003fe652e9ffc0901f9a1a9e79b2c46bb693d695bb7ef77306ec92258ba64","observation_id":"20bc62c3-e26f-4973-ad84-55627d568850","resolution":{"observed_at":"2026-08-09T22:08:49.518559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T22:08:50.333499Z","title":"If you like shapley then you’ll love the core","venue":null,"work_id":"bc83fc11-73a5-4544-8fcb-bf12ff85882e","year":2021},"citing_paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-09T22:08:49.522940Z"},"links":{"citing_paper":"/paper/2501.18887"},"observation_digest":"sha256:dc44f2bc40865cf51ebc01afe114afe6c7e500bd0e83d7782a0f52bea13f458c","observation_id":"2f43371f-27ff-4097-8a43-c954b9c2460c","resolution":{"observed_at":"2026-08-09T22:08:50.353113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.18887","last_updated":"2025-05-29T16:49:00Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T22:01:38.611459Z","submitted_at":"2025-01-31T04:42:45Z","title":"Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":73,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":104},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 2 inbound Pith citation observations for arXiv:2501.18887."}