{"as_of":"2026-08-13T13:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21b8db3958486c9d87e8913b60898bb79f9fb792a526e9524b2f7f35851a3b58","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:42:30.457155Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17992/citation-record","integrity":"/paper/2411.17992/integrity","json":"/paper/2411.17992/citation-record.json","paper":"/paper/2411.17992"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.068752Z","title":"Visualizing memorization in RNNs,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.068752Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:4618d22e1e9105042f3c58bf05afeaf81c74a226da82666c2dde4d9fba5b9876","observation_id":"4dbbf998-4f69-4133-a9fe-560d0dca30e4","resolution":{"observed_at":"2026-08-12T11:42:30.068752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.073328Z","title":"Attention is not Explanation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.073328Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:a846093affa83cd72a1a130cc81b13313def7c68b59aed9e547451e8bc771210","observation_id":"f5d6a615-773e-481e-a399-dadd3d228ee4","resolution":{"observed_at":"2026-08-12T11:42:30.073328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09237","last_updated":"2019-04-19T16:21:38Z","snapshot_observed_at":"2026-08-03T03:50:23.110540Z","submitted_at":"2019-04-19T16:21:38Z","title":"On the Convergence of Adam and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09237","snapshot_observed_at":"2026-08-12T11:42:30.077319Z","title":"On the convergence of Adam and beyond,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.077319Z"},"links":{"cited_paper":"/paper/1904.09237","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:cbb6b17f893db239d6d6bf07fe302990dea15e9cc274fb40555ca6af77eef86c","observation_id":"9c63864d-a19a-48cc-982e-e878d954d0d0","resolution":{"observed_at":"2026-08-12T11:42:30.077319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-12T11:42:30.081840Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.081840Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:b3baf65cc07d5c37cedee7957a9f5902cdc20d3cf06ef260cc6f6270720d8373","observation_id":"945f9aca-00e1-43fd-92b9-8334a0abd655","resolution":{"observed_at":"2026-08-12T11:42:30.081840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-12T11:42:30.086093Z","title":"Transformers: State-of-the-Art Natural Language Processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.086093Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:29c3bdd8b721975cab0be0f49a0914e1ca47be9b25aeddd78811388f77519871","observation_id":"4d82cd8a-bbf8-469a-b2ab-86eee458d587","resolution":{"observed_at":"2026-08-12T11:42:30.086093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.091430Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.091430Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:f128bf974f46241a4776018241fd5a0e80eb4e5a7973654b0c11124a19e78a32","observation_id":"2d2617ee-a103-42eb-89b9-d1c95d9c4c4d","resolution":{"observed_at":"2026-08-12T11:42:30.091430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.095596Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.095596Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:f81edc8741b303ea82500677154d4d618196825b92fe4ce771fe217275bb26ed","observation_id":"62e7a3fd-7b47-4937-91c8-6f5e43289587","resolution":{"observed_at":"2026-08-12T11:42:30.095596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.103542Z","title":"SuperGLUE: A stickier benchmark for general-purpose language understanding systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.103542Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:1eb36c396f9983103d22203557579062e800d8fd052386746f8551a1db86221d","observation_id":"0e32c4a9-d168-4367-86dd-3fa2d6400ed2","resolution":{"observed_at":"2026-08-12T11:42:30.103542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.107249Z","title":"MIMIC-III, a freely accessible critical care database,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.107249Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:e1cadc0b4563f595148ce826b8d0bf683a269e641abe31d110d8d78e16bd0f08","observation_id":"2e1c7f7d-9620-4b81-be4e-4a260c0ea192","resolution":{"observed_at":"2026-08-12T11:42:30.107249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05698","last_updated":"2015-12-31T13:08:14Z","snapshot_observed_at":"2026-07-06T04:09:45.600447Z","submitted_at":"2015-02-19T20:46:10Z","title":"Towards AI-Complete Question Answering: A Set of Prerequisite Toy Tasks","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05698","snapshot_observed_at":"2026-08-12T11:42:30.111115Z","title":"Towards AI-complete question answering: A set of prerequisite toy tasks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.111115Z"},"links":{"cited_paper":"/paper/1502.05698","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:4a8952ce2e6618abe203b56d3ef47b242e160fb74fa57c910a74f22f20022f52","observation_id":"17a0ce51-5bc5-488e-9d35-7238a69947fd","resolution":{"observed_at":"2026-08-12T11:42:30.111115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.115486Z","title":"Right for the Wrong Reasons: Diagnosing Syntactic Heuristics in Natural Language Inference,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.115486Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:1ddbc597b3aebb6add00a3971fd1686d35bd1b6b5d6f99e02205f3208dcab5b3","observation_id":"d65aaf84-0f4a-47e2-b6b5-85202a8a7c24","resolution":{"observed_at":"2026-08-12T11:42:30.115486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.119083Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.119083Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:58b9c3c6a4c01752f7af50f362723df6de8f990c64d5e5bd84ee7427c6f7a689","observation_id":"41c6acbd-62d0-43d7-bc53-fd499d304f5a","resolution":{"observed_at":"2026-08-12T11:42:30.119083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.122786Z","title":"Parsing with compositional vector grammars,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.122786Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:e4c7aae0b22a9c79bcd41e91d091d49d5d11ef9b7deed5b268ceb70553dcab4b","observation_id":"cbf062a8-70bc-4d32-941f-e2de060290e1","resolution":{"observed_at":"2026-08-12T11:42:30.122786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10758","last_updated":"2019-11-05T02:25:30Z","snapshot_observed_at":"2026-08-08T22:47:48.693121Z","submitted_at":"2018-06-28T03:46:57Z","title":"A Benchmark for Interpretability Methods in Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10758","snapshot_observed_at":"2026-08-12T11:42:30.126213Z","title":"A benchmark for interpretability methods in deep neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.126213Z"},"links":{"cited_paper":"/paper/1806.10758","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:338b4cfb5b32be92a04830d7aaf4ee49fbfb0c26d04d7b1f6b05b38852084431","observation_id":"226948c1-8f30-4d05-a399-2cd26a35f07b","resolution":{"observed_at":"2026-08-12T11:42:30.126213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.130319Z","title":"Semantically Equivalent Adversarial Rules for Debugging NLP models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.130319Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:20fa6d5f908801281f98144b365491940fc7a65fc52b53c2a7076d21e1c518ae","observation_id":"67c520e1-d684-4350-a317-151986e92a3f","resolution":{"observed_at":"2026-08-12T11:42:30.130319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.133847Z","title":"Investigating Gender Bias in Language Models Using Causal Mediation Analysis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.133847Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:1756248db6383cdc3b78253978a0e635bbf303b87ad5e5e2433b716c85e98962","observation_id":"86e1f5eb-b697-48e6-a3fd-700b6c0da43f","resolution":{"observed_at":"2026-08-12T11:42:30.133847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.137298Z","title":"LIII. On lines and planes of closest fit to systems of points in space,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.137298Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ce8c73e53eea958133666b8db7df7ee87680ec9a5f345a7710d60efe7fd97f75","observation_id":"46e9a46d-e565-42eb-9eae-ceb13b5b89aa","resolution":{"observed_at":"2026-08-12T11:42:30.137298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.140855Z","title":"Visualizing data using t-SNE,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.140855Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:b6e68035e473a8646d6e782fb166e5bbbc2b2f4a6b7ff5936ffa19ba4ed07fb6","observation_id":"54d4eb38-2f5f-481b-92c6-16d2d326d75d","resolution":{"observed_at":"2026-08-12T11:42:30.140855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.144598Z","title":"Glove: Global Vectors for Word Representation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.144598Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:de5fb48b87d6c84c019bbbf857f6445ecc358cc420b9c6194399f38315b5f7f6","observation_id":"e1d1db51-17de-4127-bab6-5a29d4a854d6","resolution":{"observed_at":"2026-08-12T11:42:30.144598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.148117Z","title":"BERT Rediscovers the Classical NLP Pipeline,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.148117Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:3c03f7869545b4c9d297881f6a20a5dcb3805befee6217337083c208f3514999","observation_id":"40600b56-0122-43a8-9cd3-c6bf8142cdb0","resolution":{"observed_at":"2026-08-12T11:42:30.148117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T11:42:30.151759Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.151759Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2e57dc4ae5d2392a0895d4634be54902f4f9fc61ca85627ddcfe0276a20b0440","observation_id":"e7157b4c-0b55-4ec5-b66b-166737a4753c","resolution":{"observed_at":"2026-08-12T11:42:30.151759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.155716Z","title":"Boolq: Exploringthesurprisingdifficultyofnaturalyes/noquestions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.155716Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:87ca3e41315f2e2062b289ebd45f3823e1e3b734c12fe85a792a4ec3058a9604","observation_id":"8fcccc03-4acb-4004-a256-d3b4c63abd1c","resolution":{"observed_at":"2026-08-12T11:42:30.155716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.159419Z","title":"The CommitmentBank: Investigating projection in naturally occurring discourse,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.159419Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2998d1a0277207357e6ca53e5d2b3468befb5e94d08d197b00caf0f66c4f4b68","observation_id":"cc3fb536-22fc-4bd9-852f-8fa8bc6e95ef","resolution":{"observed_at":"2026-08-12T11:42:30.159419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.162807Z","title":"Neural Network Acceptability Judgments,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.162807Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:b47fd9c8f921c245eaab398b6ca4df0abdfab08313137afe85b9a3dfe6dcb886","observation_id":"970d1ace-84cf-481c-93d5-b6ac135e3936","resolution":{"observed_at":"2026-08-12T11:42:30.162807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.170763Z","title":"CommonsenseQA: A Question Answering Challenge Targeting Commonsense Knowledge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.170763Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:0cdb7f896bfb854ac1d6589870b0b76b38207d292e2711ee8edc29cbe5ecc2ff","observation_id":"85a6a9ce-d400-4e40-8c15-d1c096b34c45","resolution":{"observed_at":"2026-08-12T11:42:30.170763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.166759Z","title":"Available: https://direct.mit.edu/tacl/article/43528","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.166759Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:cda511c91c24d81348a3b078c2d34fafb49fc42f96f067843efab2a42425b910","observation_id":"019bab1e-9f1d-4986-ba80-f1448db0e6e9","resolution":{"observed_at":"2026-08-12T11:42:30.166759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.178806Z","title":"Automatically Constructing a Corpus of Sentential Paraphrases,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.178806Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:5eae15106a68c8764a61e1f47a8917df61667e1611d885bf94b8971732eac083","observation_id":"a57e3e84-9d9a-4ba9-bb7d-e21b7efbcc58","resolution":{"observed_at":"2026-08-12T11:42:30.178806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.175087Z","title":"Learning word vectors for sentiment analysis,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.175087Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:93799558bc4052537f26fe55b30b263b24602087e3a48ebfb02b133102254c53","observation_id":"d5fee3a8-fc04-414f-8c40-b8ccb22285a4","resolution":{"observed_at":"2026-08-12T11:42:30.175087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.186048Z","title":"The PASCAL Recognising Textual Entailment Challenge,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.186048Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:b6fe6085a1a4ad6e10c6430690179d3ed4ac8086c48df5472060ac59e200197c","observation_id":"7569805f-7a51-4830-aed7-f201e316ffff","resolution":{"observed_at":"2026-08-12T11:42:30.186048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.182381Z","title":"MCTest: A challenge dataset for the open-domain machine comprehension of text,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.182381Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:100bbba69b35565a7693dac191a1d4cc89c8190ea160988b656446b0dac972ba","observation_id":"7d24b2ca-9c01-4861-bb49-a02d8a29b54e","resolution":{"observed_at":"2026-08-12T11:42:30.182381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.193860Z","title":"SQuad: 100,000+ questions for machine comprehension of text,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.193860Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:8a740ca2b5846f15e6471aae7ad8c8c9011bdd4a380160b8d6e11767c322613e","observation_id":"560be9a9-1949-4455-94f4-a558da646cc4","resolution":{"observed_at":"2026-08-12T11:42:30.193860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.190397Z","title":"A large annotated corpus for learning natural language inference,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.190397Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ddab1b0a45f43325186c810a00bfb42363e61ea60cf3eafb690aada003a307e2","observation_id":"4425f6df-5303-48dc-be2e-1c3bb6807578","resolution":{"observed_at":"2026-08-12T11:42:30.190397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.205257Z","title":"Long Short-Term Memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.205257Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:86f3fc19e4fe1c5bc19252c391ac394e32f519e194696d39c0191239df5a8b59","observation_id":"04f1c5c9-5271-4a0e-9fb7-ab77292586a6","resolution":{"observed_at":"2026-08-12T11:42:30.205257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.197382Z","title":"First Quora Dataset Release: Question Pairs,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.197382Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:fdb1b9ecc931b64b2b2e3e20a01af848c8a6379b51a993a41322b12a31fe00e7","observation_id":"6a715a96-9d02-46d5-94bb-7ccd6e0ce679","resolution":{"observed_at":"2026-08-12T11:42:30.197382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08696","last_updated":"2023-02-03T01:45:51Z","snapshot_observed_at":"2026-08-09T21:22:44.471516Z","submitted_at":"2022-05-18T02:52:03Z","title":"The Solvability of Interpretability Evaluation Metrics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08696","snapshot_observed_at":"2026-08-12T11:42:30.212359Z","title":"The Solvability of Interpretability Evaluation Metrics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.212359Z"},"links":{"cited_paper":"/paper/2205.08696","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:5beb83e39943a7dfe49a2928850908898d7d2471df4a19641efb8e45a4a4c17c","observation_id":"77ce47e5-7391-44aa-a15f-14a7b53430df","resolution":{"observed_at":"2026-08-12T11:42:30.212359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.215954Z","title":"Explain Yourself! Leveraging Language Models for Commonsense Reasoning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.215954Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:43c4ba337cf642cb42f13f7f361d872a9bebd5672b877e87391063bc1c9af94b","observation_id":"fb7b5729-6597-4c99-9380-05317fb1d02a","resolution":{"observed_at":"2026-08-12T11:42:30.215954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.208887Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.208887Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:608f43b9fe6a2c8c25cf1bee23376c9f06a7678275c712fe9c4c6c90debac536","observation_id":"b232c111-d7f9-4934-913e-30abeaaa3e95","resolution":{"observed_at":"2026-08-12T11:42:30.208887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.223011Z","title":"Visualizing and Understanding Neural Models in NLP,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.223011Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:4ffe534ff2de0643af579084a5d0fd984eb4f63fe65aa094d8d2780c1b79f4d1","observation_id":"7b93bc2c-ce3e-4a05-97e5-cb591d6862dd","resolution":{"observed_at":"2026-08-12T11:42:30.223011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01365","last_updated":"2017-06-13T01:52:38Z","snapshot_observed_at":"2026-07-06T05:32:18.507883Z","submitted_at":"2017-03-04T00:18:49Z","title":"Axiomatic Attribution for Deep Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01365","snapshot_observed_at":"2026-08-12T11:42:30.226505Z","title":"Axiomatic attribution for deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.226505Z"},"links":{"cited_paper":"/paper/1703.01365","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:3575777c602422654beedc931bcb1885b9a04695205149cf7312a1f6dbd0186b","observation_id":"742e6cb9-7226-46bd-a8f4-f99cc7dcc553","resolution":{"observed_at":"2026-08-12T11:42:30.226505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0912.1128","last_updated":"2009-12-06T19:29:04Z","snapshot_observed_at":"2026-08-08T14:35:54.572620Z","submitted_at":"2009-12-06T19:29:04Z","title":"How to Explain Individual Classification Decisions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0912.1128","snapshot_observed_at":"2026-08-12T11:42:30.219458Z","title":"How to explain individual classification decisions,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.219458Z"},"links":{"cited_paper":"/paper/0912.1128","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2308014f86488087d2416ca970c7b5ca8f261a823d1fba04a6cf4c3e56bfb2b9","observation_id":"eda52323-a677-43b3-8ade-2191f49b1b43","resolution":{"observed_at":"2026-08-12T11:42:30.219458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.234046Z","title":"\"Why should i trust you?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.234046Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:8c2e08f423dea414d71633e11c0a2b479e816b120f6671f7e0dbc59c9b97d454","observation_id":"716d6066-e6ef-42f6-a616-b78999f5e9fe","resolution":{"observed_at":"2026-08-12T11:42:30.234046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.237481Z","title":"Explaining NLP Models via Minimal Contrastive Editing (MiCE),","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.237481Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:a695a00c29d4cf7414aef516800e87187abc5da66208cb67f595df6a1b528d23","observation_id":"a7149b78-1bf2-4b6f-8f31-c95e7f11dcb3","resolution":{"observed_at":"2026-08-12T11:42:30.237481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.230310Z","title":"Understanding Neural Networks through Representation Erasure,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.230310Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ee11a8c0f349c5402c81d181e13371675a8ba9e29986c890a28a93628d91a6c8","observation_id":"8cd1d528-2b43-405b-839f-96a97ffece0a","resolution":{"observed_at":"2026-08-12T11:42:30.230310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07874","last_updated":"2017-11-25T03:53:32Z","snapshot_observed_at":"2026-07-06T05:43:42.722222Z","submitted_at":"2017-05-22T17:38:10Z","title":"A Unified Approach to Interpreting Model Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07874","snapshot_observed_at":"2026-08-12T11:42:30.244236Z","title":"A Unified Approach to Interpreting Model Predictions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.244236Z"},"links":{"cited_paper":"/paper/1705.07874","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:20699927a0b14fb7076ab42b81653ca635e108c5c90fba1cfa3bcbadf72a684e","observation_id":"083de751-4e4c-4bd5-ba1b-320c4533ef76","resolution":{"observed_at":"2026-08-12T11:42:30.244236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.03292","last_updated":"2020-11-06T13:40:14Z","snapshot_observed_at":"2026-07-06T07:06:35.439966Z","submitted_at":"2018-10-08T07:27:11Z","title":"Sanity Checks for Saliency Maps","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.03292","snapshot_observed_at":"2026-08-12T11:42:30.248188Z","title":"Sanity checks for saliency maps,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.248188Z"},"links":{"cited_paper":"/paper/1810.03292","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:fc75827a9544fcc735ffb62c741086de2c0534bed69005e36b4aa9702196021c","observation_id":"7206b666-4d51-479d-8368-9b2a41edd15a","resolution":{"observed_at":"2026-08-12T11:42:30.248188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.240789Z","title":"NILE : Natural Language Inference with Faithful Natural Language Explanations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.240789Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:edc6331256ddbfdef7b3b1f92d864130a3e6b0c6c4af0521815bf4534ace5e80","observation_id":"78c3eaaf-834b-40a5-9ef4-f547f053e07f","resolution":{"observed_at":"2026-08-12T11:42:30.240789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.255510Z","title":"Explainable Machine Learning in Deployment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.255510Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:be6a1055a735a7cf36fc8d58b22b54394cc71ea6ca96f264dfacd8d9fe9d84f7","observation_id":"14b58338-1c9b-430f-bda3-1cc529a2be79","resolution":{"observed_at":"2026-08-12T11:42:30.255510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.258954Z","title":"Stop explaining black box machine learning models for high stakes decisions and use interpretable models instead,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.258954Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:0cd0f741ff8788a343dc5e7a9adddc1cfb91dcde1eeaa23b74a42848c66b1b0c","observation_id":"ff212e78-b69a-40ad-b46a-60fe737771b0","resolution":{"observed_at":"2026-08-12T11:42:30.258954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.251987Z","title":"A Statistical Framework for Efficient Out of Distribution Detection in Deep Neural Networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.251987Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:a78b1eb9fa90e19264196e33eae39e4bca06ca074e3254ac28f6fbd78acdeb53","observation_id":"e0e6499d-a75f-471c-96d4-4062126668a0","resolution":{"observed_at":"2026-08-12T11:42:30.251987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.266018Z","title":"How bad is Sacramento’s air, exactly? Google results appear at odds with reality, some say,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.266018Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:27d2851590ac330df888d607246d37db3c1806eda4c2767936932d3c7db810e5","observation_id":"3c9d3fb0-8839-477a-8fcf-322c45035728","resolution":{"observed_at":"2026-08-12T11:42:30.266018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.269669Z","title":"On the Safety of Machine Learning: Cyber-Physical Systems, Decision Sciences, and Data Products,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.269669Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:04b0b864d181a4204635ce675935636e54310666ff8875927d64dab167a68285","observation_id":"be127890-a25a-411b-93d1-e6718f444eb6","resolution":{"observed_at":"2026-08-12T11:42:30.269669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.262573Z","title":"When a computer program keeps you in jail: How computers are harming criminal justice,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.262573Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:bfd40d0b17eadaee33670f256e92920cd37f391e522d4f16999aed3d840f496b","observation_id":"e670b5a1-5c34-4462-b9ce-af9644eb2cd2","resolution":{"observed_at":"2026-08-12T11:42:30.262573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.280483Z","title":"Dissecting racial bias in an algorithm used to manage the health of populations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.280483Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2db7e81226f8c981d257ca6ff8b05bb9b85fe33fdc1d98daff31ebd01dfce4ef","observation_id":"1a00f3c1-486b-4807-8600-2ba3102dc972","resolution":{"observed_at":"2026-08-12T11:42:30.280483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.283744Z","title":"Language Models are Few-Shot Learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.283744Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:9b6ce11695ea4e4473f59936ca4fd00bc1bca8475dcbaf45d91f8a75febb098a","observation_id":"7cce3445-23f5-4330-b8b0-44b76a59256b","resolution":{"observed_at":"2026-08-12T11:42:30.283744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.273259Z","title":"Available: http://www.ncbi.nlm.nih.gov/pubmed/28933947 107","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.273259Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:a36e5d600f9e4c48ce32901e3963efdeca9879b6999c712128ccaaa9a05b1efd","observation_id":"5be35629-3d7c-498a-9025-543431cb9fff","resolution":{"observed_at":"2026-08-12T11:42:30.273259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.276825Z","title":"Accountability of AI Under the Law: The Role of Explanation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.276825Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:29105a195f80387e08771145afeabdd1fdc59b65a462528b0b2119d82c122f3a","observation_id":"8b5a7d6a-8998-4fce-b0e3-2ee82bbbf112","resolution":{"observed_at":"2026-08-12T11:42:30.276825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.293991Z","title":"A Survey on Bias in Deep NLP,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.293991Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:1588d3d4b33660051228a552d683ca83dfeefe7d9d67950f53c51b874d6db73e","observation_id":"72603a94-0d4e-47db-94b0-f8d7f1a4bae8","resolution":{"observed_at":"2026-08-12T11:42:30.293991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-13T03:10:58.738032Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-12T11:42:30.297395Z","title":"Towards A Rigorous Science of Interpretable Machine Learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.297395Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:d894dffa293efc90335ab940a79eaa7a66e80e3342e5cbdd898b9411598dbe6a","observation_id":"8b0b55fc-0a61-4708-a43a-b8fab1b2ae2f","resolution":{"observed_at":"2026-08-12T11:42:30.297395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.286986Z","title":"On the Dangers of Stochastic Parrots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.286986Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:29acf3f3e6ccbdfb1a713fc8274bca267215e408eefcdeee709d1bb7f57d226a","observation_id":"22a79d2e-3bd8-490e-b6cd-adc9e3c45459","resolution":{"observed_at":"2026-08-12T11:42:30.286986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.290605Z","title":"A Survey on Bias and Fairness in Machine Learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.290605Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:332df837da20b4334e678deef5a5c2006344152500fa249a5b28905315e6c6aa","observation_id":"846e408e-41ea-4454-96a5-c02d20cc3083","resolution":{"observed_at":"2026-08-12T11:42:30.290605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.307753Z","title":"The mythos of model interpretability,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.307753Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:19436a4e9ed1afcea6f060ccb3c3ecdc6ba3e6460215fc7114a8241b6345c635","observation_id":"b3199b2b-cad0-4859-90f1-46e51ffbd3a8","resolution":{"observed_at":"2026-08-12T11:42:30.307753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.312157Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.312157Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:0c99e2d5408947b5903f3d2b7d1f53d71dda9cc49ea3b2c5f14f3082025f5678","observation_id":"71bca287-f86d-4ed7-8738-a1c231f00afc","resolution":{"observed_at":"2026-08-12T11:42:30.312157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.300866Z","title":"Towards Faithfully Interpretable NLP Systems: How Should We Define and Evaluate Faithfulness?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.300866Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:9b6b4b69aab1af6697caf73a5639dec57cdc88ebae5742c324ca5cdaeb0a2255","observation_id":"22bdcd1f-05da-4294-b6ed-0d6ed93b6d14","resolution":{"observed_at":"2026-08-12T11:42:30.300866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.304388Z","title":"Evaluating the Visualization of What a Deep Neural Network Has Learned,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.304388Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ee815fcc8ff7cfe188d8d45200c7a6fcf1cf480b3a78b2e3a6350aa4b0c312de","observation_id":"66da27c0-81e8-4d9b-8c06-5a2655c18db3","resolution":{"observed_at":"2026-08-12T11:42:30.304388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.322839Z","title":"What we can’t measure, We can’t understand: Challenges to demographic data procurement in the pursuit of fairness,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.322839Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:5fbb60d326e1349004d4bd8cea1785bc3625b79f0cb2276da48c51be2820fb3e","observation_id":"b4c49125-fe3c-4223-bd67-35a463dbd2c8","resolution":{"observed_at":"2026-08-12T11:42:30.322839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.326179Z","title":"An overview of ethical issues in using AI systems in hiring with a case study of Amazon’s AI based hiring tool,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.326179Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:419fc72049b8b95cfa691eb9a94ea81584034e90cd5e41e001f39521ae18f066","observation_id":"e18c986b-71f1-47b5-abee-e9c10c07154a","resolution":{"observed_at":"2026-08-12T11:42:30.326179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.315622Z","title":"Barocas, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.315622Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:71705477c88ea0cdfa519bce1e549ff68a8720875f662aac2e48bca225bcb77f","observation_id":"2d83608f-79fe-48c8-a5ef-23b2c1ffe19a","resolution":{"observed_at":"2026-08-12T11:42:30.315622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.00761","last_updated":"2019-11-25T21:28:46Z","snapshot_observed_at":"2026-08-10T16:28:15.216559Z","submitted_at":"2019-11-25T21:28:46Z","title":"On the Legal Compatibility of Fairness Definitions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.00761","snapshot_observed_at":"2026-08-12T11:42:30.319183Z","title":"On the Legal Compatibility of Fairness Definitions,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.319183Z"},"links":{"cited_paper":"/paper/1912.00761","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:048b8a6be1e897a3b1914a7a5870ab0ba449f76b1976702291175276a68c80d3","observation_id":"f4440c5b-8ff7-4964-8652-0e619486e17d","resolution":{"observed_at":"2026-08-12T11:42:30.319183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.335692Z","title":"Interpretable deep learning in drug discovery,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.335692Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:4a91e08833edb3a28498de5dafcac220bd058a9468f75ce374880e687ee7326b","observation_id":"6259d4bb-3108-4ce2-a498-aa85ef206829","resolution":{"observed_at":"2026-08-12T11:42:30.335692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.338984Z","title":"Drug discovery with explainable artificial intelligence,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.338984Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ce27396a9c5a8ffd0e6038690feea33a04266c04188cb69cc4b8d3a0061ae20d","observation_id":"19b10aa5-d68b-4d1d-b95f-e99a23468849","resolution":{"observed_at":"2026-08-12T11:42:30.338984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.329275Z","title":"Hidden Workers: Untapped Talent,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.329275Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2333af7ec16f2e6efb9ec2238321aad84022735347be81ab31105b7d2ea43a9a","observation_id":"f62f9add-ea04-4967-8b52-c0de68f9b954","resolution":{"observed_at":"2026-08-12T11:42:30.329275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.332511Z","title":"Companies Need More Workers. Why Do They Reject Millions of Résumés?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.332511Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:2debc57542b8d121c439b636aab05935c7d33c1331bc1c77a0f8681443481593","observation_id":"4fc3b34f-fdf3-4212-97fb-b925dda73aef","resolution":{"observed_at":"2026-08-12T11:42:30.332511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.349272Z","title":"A Mathematical Framework for Transformer Circuits,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.349272Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:d66292881de5067237c640fc48e8ab505edd31ac42e764325ace94f056ec0d97","observation_id":"0c6c4b17-c3ff-4181-b98d-21e0afe8d35c","resolution":{"observed_at":"2026-08-12T11:42:30.349272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.355802Z","title":"AIintheUK:Ready, WillingandAble?","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.355802Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:5d2adb42139285159691e00e445c3f9129cfd7f0ed5d8febfee5d6e321930d1f","observation_id":"f4b69995-7f0a-4e04-b234-8abb6e7a68d6","resolution":{"observed_at":"2026-08-12T11:42:30.355802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.342484Z","title":"Machine learning in drug discovery: a review,","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.342484Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:bef9157d2a77393572a44a0f288e0d5e4e6e3ca6a46f9d1ad1e15bb7d870a3b4","observation_id":"e090db19-f03f-48ac-98b3-116102d25022","resolution":{"observed_at":"2026-08-12T11:42:30.342484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.346019Z","title":"Thread: Circuits,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.346019Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:d080cd61e382b8a1968f01b34d3a79189ddfe1b4e21285811f9cbe5aa24c5ee8","observation_id":"bad3d472-4488-4f48-97f1-97add21c28a5","resolution":{"observed_at":"2026-08-12T11:42:30.346019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03012","last_updated":"2019-09-14T15:08:57Z","snapshot_observed_at":"2026-07-06T08:19:45.897686Z","submitted_at":"2019-09-06T16:53:01Z","title":"One Explanation Does Not Fit All: A Toolkit and Taxonomy of AI Explainability Techniques","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03012","snapshot_observed_at":"2026-08-12T11:42:30.366412Z","title":"One Explanation Does Not Fit All: A Toolkit and Taxonomy of AI Explainability Techniques,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.366412Z"},"links":{"cited_paper":"/paper/1909.03012","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:f8977d227afcd58729c210264f3b2cc4178ef80f19c60c2b8522bec80855214d","observation_id":"30896941-f1de-41d4-8eef-b252a420fa6b","resolution":{"observed_at":"2026-08-12T11:42:30.366412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.370339Z","title":"Definitions, methods, and applications in interpretable machine learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.370339Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:221c22448e2f8ec4d999baf6e4bd1b12fd7130c3638c5258ca77edece935ce39","observation_id":"3b9d3b58-b123-43b4-a834-253935230acd","resolution":{"observed_at":"2026-08-12T11:42:30.370339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-12T11:42:30.374180Z","title":"Neural machine translation by jointly learning to align and translate,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.374180Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ce89e98903bcc2aadb0853c1a784d19717d51d594b1fa7f58a1834e7de8c9e2e","observation_id":"2714af6f-4ee2-4029-bae8-d755d3c11059","resolution":{"observed_at":"2026-08-12T11:42:30.374180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.359186Z","title":"Machine Learning Interpretability: A Survey on Methods and Metrics,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.359186Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:aa22ab0897f652331d30ad8339ab3112026a26bfa6ab5209d5ab3799296c59f2","observation_id":"d5bf9960-55d6-4576-a327-5cafd0e9ad31","resolution":{"observed_at":"2026-08-12T11:42:30.359186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08943","last_updated":"2022-11-16T14:45:16Z","snapshot_observed_at":"2026-08-11T00:22:37.833048Z","submitted_at":"2022-11-16T14:45:16Z","title":"Comparing Explanation Methods for Traditional Machine Learning Models Part 1: An Overview of Current Methods and Quantifying Their Disagreement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.08943","snapshot_observed_at":"2026-08-12T11:42:30.362597Z","title":"Comparing Explanation Methods for Traditional Machine Learning Models Part 1: An Overview of Current Methods and Quantifying Their Disagreement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.362597Z"},"links":{"cited_paper":"/paper/2211.08943","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:c00ac24127d7967ad13a75eac0a2d79b05c0fd07356fb8b80a3733bfe76d72c3","observation_id":"f97b965a-e9cd-44ac-9a8f-cbb769ee942c","resolution":{"observed_at":"2026-08-12T11:42:30.362597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.384889Z","title":"Neural module networks: A review,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.384889Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:4a75e5eeff0ab13904a62595c29742ef02ed9ea26f7e2ad8b948f7e1ce13ca35","observation_id":"bae1a595-249c-4ee9-b028-d819fc86ccff","resolution":{"observed_at":"2026-08-12T11:42:30.384889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0908.2284","last_updated":"2009-08-17T05:10:22Z","snapshot_observed_at":"2026-07-06T01:59:44.381684Z","submitted_at":"2009-08-17T05:10:22Z","title":"Classification by Set Cover: The Prototype Vector Machine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0908.2284","snapshot_observed_at":"2026-08-12T11:42:30.392150Z","title":"Classification by Set Cover: The Prototype Vector Machine,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.392150Z"},"links":{"cited_paper":"/paper/0908.2284","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:f219f7b413b4ec45ec8edb779614ceb966fdf04e727ffd745edfe99a4ae388af","observation_id":"8de97cf8-e174-47fc-ab48-5d6101ec7daf","resolution":{"observed_at":"2026-08-12T11:42:30.392150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.395994Z","title":"The Bayesian case model: A generative approach for case-based reasoning and prototype classification,","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.395994Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:1c8e4e05962c186c1895c585dfca68f44d4e1d724418a1db3b5ab71441f1d293","observation_id":"39cc7f99-1c93-4c38-82ec-339161cfb66a","resolution":{"observed_at":"2026-08-12T11:42:30.395994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.378117Z","title":"Neural Module Networks,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.378117Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:0c3bdf32e33b0cd31518d1352c6288ad8150f428869c7f28ce0025ce84dbd962","observation_id":"ad5e9735-b71c-4756-9abd-fb4f1945b0c1","resolution":{"observed_at":"2026-08-12T11:42:30.378117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.381369Z","title":"Neural Module Networks for Reasoning over Text,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.381369Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:585782ba30db3fb7ebd02f129110a2970a8be91e35fd81dea92bbc113d0da621","observation_id":"1ab27a9e-1aa4-49b0-8346-9f607757072a","resolution":{"observed_at":"2026-08-12T11:42:30.381369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02078","last_updated":"2015-11-17T02:42:24Z","snapshot_observed_at":"2026-08-04T02:12:07.668406Z","submitted_at":"2015-06-05T22:33:04Z","title":"Visualizing and Understanding Recurrent Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02078","snapshot_observed_at":"2026-08-12T11:42:30.410929Z","title":"Visualizing and Understanding Recurrent Networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.410929Z"},"links":{"cited_paper":"/paper/1506.02078","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:430dc197cd42b2fa1656762c8a38311d2e6aaf73ebbd915965240825f74786be","observation_id":"2114dd0f-1cba-4d2e-a56d-e0e925e0bf95","resolution":{"observed_at":"2026-08-12T11:42:30.410929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.414812Z","title":"Is Attention Interpretable?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.414812Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:c3a3e6a0044316549e01c221bb5bf901d2a8356d2ed406e7501549302c9887de","observation_id":"6e93b2cd-dc83-4935-a90f-173181424bd1","resolution":{"observed_at":"2026-08-12T11:42:30.414812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11218","last_updated":"2019-09-24T22:58:44Z","snapshot_observed_at":"2026-08-13T04:44:49.825402Z","submitted_at":"2019-09-24T22:58:44Z","title":"Attention Interpretability Across NLP Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11218","snapshot_observed_at":"2026-08-12T11:42:30.418236Z","title":"Attention Interpretability Across NLP Tasks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.418236Z"},"links":{"cited_paper":"/paper/1909.11218","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:e552dc0599ebd4a72ed81179ac2a1d39fbe9adc07e8632f67d8131c7d2c11039","observation_id":"8fe778f3-3237-408f-9b87-e1b2e483eb0b","resolution":{"observed_at":"2026-08-12T11:42:30.418236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01087","last_updated":"2021-06-08T12:39:49Z","snapshot_observed_at":"2026-08-03T19:06:45.958735Z","submitted_at":"2021-06-02T11:42:56Z","title":"Is Sparse Attention more Interpretable?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01087","snapshot_observed_at":"2026-08-12T11:42:30.421890Z","title":"Is Sparse Attention more Interpretable?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.421890Z"},"links":{"cited_paper":"/paper/2106.01087","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:3d578fae29d9927ac0218ec3cace56706571a96b1c7adfb9cb27d883f21246f2","observation_id":"e88d9e8f-10bb-4b7f-a3e9-c6ae1fc4798e","resolution":{"observed_at":"2026-08-12T11:42:30.421890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10574","last_updated":"2019-12-28T20:12:11Z","snapshot_observed_at":"2026-07-06T06:47:10.993032Z","submitted_at":"2018-06-27T17:18:03Z","title":"This Looks Like That: Deep Learning for Interpretable Image Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10574","snapshot_observed_at":"2026-08-12T11:42:30.399473Z","title":"This looks like that: Deep learning for interpretable image recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.399473Z"},"links":{"cited_paper":"/paper/1806.10574","citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:75ab03d22c14c8cc398b4e5476a5f64bb7be52108e1c08a4f1239ae531d69fe3","observation_id":"cfbfcb08-74b5-4d4d-a937-b594664efbb6","resolution":{"observed_at":"2026-08-12T11:42:30.399473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.403871Z","title":"Noise-adding Methods of Saliency Map as Series of Higher Order Partial Derivative,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.403871Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:6990615479926be1cde9d594747522b1bbba2c53b2dec9760ce29b9c96948d45","observation_id":"032af345-32d7-471b-915d-63fc52afb771","resolution":{"observed_at":"2026-08-12T11:42:30.403871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.432579Z","title":"European union regulations on algorithmic decision making and a","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.432579Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:190e045ff0ea2288cdc272be040a92759d996d2b42470a41094d6b7227d2792b","observation_id":"7e123913-3bdd-4072-957f-d8511b78f2da","resolution":{"observed_at":"2026-08-12T11:42:30.432579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.436148Z","title":"The Disagreement Problem in Explainable Machine Learning: A Practitioner’s Perspective,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.436148Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:937ed82bd0e34f4e24a6a0364761e7caca247c1611e172c08f05445486674820","observation_id":"5a037386-6101-46e3-8cd3-ad9b2715aa38","resolution":{"observed_at":"2026-08-12T11:42:30.436148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.439648Z","title":"The elephant in the interpretability room: Why use attention as explanation when we have saliency methods?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.439648Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:90db2b932351f30f88a4f0a7fa2ae6f505641f33e02b4b14881aee60785d08f2","observation_id":"c56b68d3-52c1-405d-80e4-137a79a67e39","resolution":{"observed_at":"2026-08-12T11:42:30.439648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10462-019-09706-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:31.370872Z","title":"A review of modularization techniques in artificial neural networks,","venue":null,"work_id":"04b5d679-15b5-4118-a5f3-e01e2192a1d4","year":2019},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.442812Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:e364c5949bb62b6315a0b22419852972f72f236c09690755959e30cfd0c65c8c","observation_id":"e8a2b68a-b6d6-45ac-babf-479656b44694","resolution":{"observed_at":"2026-08-12T11:42:31.375152Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.446260Z","title":"Obtaining faithful interpretations from compositional neural networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.446260Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:ba726fcdad6c1541792faa4aa6ccefded886027237cb674b1d7d73723dfd37ce","observation_id":"652ea4e5-0b11-4d64-980d-b2645737dffb","resolution":{"observed_at":"2026-08-12T11:42:30.446260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.425407Z","title":"“Will You Find These Shortcuts?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.425407Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:803a307f824ea1f30865dac0dcab0c1c39e3303b6a016a68e1a96b88a7bbbd86","observation_id":"53dad0bf-82c6-4f84-9b35-69c757d44638","resolution":{"observed_at":"2026-08-12T11:42:30.425407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.428839Z","title":"Explainable Artificial Intelligence (XAI) DARPA-BAA-16-53,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.428839Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:de82b2396e15f6c46c3510920bdc69690a124f367b9193014fa5fcd70ac367c3","observation_id":"c2ec0404-34eb-4243-8531-8755e4200cfd","resolution":{"observed_at":"2026-08-12T11:42:30.428839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:42:30.457155Z","title":"Learning important features through propagating activation differences,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-12T11:42:30.457155Z"},"links":{"citing_paper":"/paper/2411.17992"},"observation_digest":"sha256:292f96a0b7f9a18a30d52a1b210d29f6b63d7b944b6d91358261a1495e079c87","observation_id":"7af82345-7977-4e83-ba4e-111c39a843bd","resolution":{"observed_at":"2026-08-12T11:42:30.457155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.17992","last_updated":"2024-11-27T02:17:34Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T02:15:38.262748Z","submitted_at":"2024-11-27T02:17:34Z","title":"New Faithfulness-Centric Interpretability Paradigms for Natural Language Processing"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2411.17992."}