{"as_of":"2026-08-11T18:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f6ee50669f53f5557dbc2412f7330009887d51ee0f0cb0b2d373526ad5fba39e","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:42:29.029561Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:02:59.058102Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T01:56:27.425584Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"cited_work":{"arxiv_id":"2506.13060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13060","snapshot_observed_at":"2026-07-02T01:56:27.425584Z","title":"Rethinking explainability in the era of multimodal ai","venue":null,"work_id":"f0227c3b-9bef-40cf-b638-259729eec6e7","year":2025},"citing_paper":{"arxiv_id":"2508.04427","last_updated":"2026-06-11T09:27:03Z","snapshot_observed_at":"2026-08-09T05:23:29.071990Z","submitted_at":"2025-08-06T13:14:20Z","title":"Decoding the Multimodal Maze: A Systematic Review on the Adoption of Explainability in Multimodal Attention-based Models","version":1},"reference_index":132,"source":"pdf_text","source_observed_at":"2026-05-19T00:34:38.247099Z"},"links":{"cited_paper":"/paper/2506.13060","citing_paper":"/paper/2508.04427"},"observation_digest":"sha256:8422974a8feb329ea3ed8d563d0ed7d63a827e2847d07e8e76b11cf15299d0fa","observation_id":"849a45c3-d30a-4246-b015-ef3208f6beeb","resolution":{"observed_at":"2026-05-19T00:36:56.258662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13060","snapshot_observed_at":"2026-08-06T00:02:59.058102Z","title":"Agarwal, Rethinking explainability in the era of multimodal ai, arXiv preprint arXiv:2506.13060 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04427","last_updated":"2026-06-11T09:27:03Z","snapshot_observed_at":"2026-08-09T05:23:29.071990Z","submitted_at":"2025-08-06T13:14:20Z","title":"Decoding the Multimodal Maze: A Systematic Review on the Adoption of Explainability in Multimodal Attention-based Models","version":2},"reference_index":132,"source":"pdf_text","source_observed_at":"2026-08-06T00:02:59.058102Z"},"links":{"cited_paper":"/paper/2506.13060","citing_paper":"/paper/2508.04427"},"observation_digest":"sha256:9203f2107260ffb8a1a61249058e125b6e2942819746429f91fcd98114c9ca7e","observation_id":"3f2e7f19-a183-44d1-b173-0ae46d6dd0bc","resolution":{"observed_at":"2026-08-06T00:02:59.058102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"cited_work":{"arxiv_id":"2506.13060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13060","snapshot_observed_at":"2026-07-02T01:56:27.425584Z","title":"Rethinking explainability in the era of multimodal ai","venue":null,"work_id":"f0227c3b-9bef-40cf-b638-259729eec6e7","year":2025},"citing_paper":{"arxiv_id":"2605.22168","last_updated":"2026-05-21T08:39:46Z","snapshot_observed_at":"2026-07-06T23:32:30.578213Z","submitted_at":"2026-05-21T08:39:46Z","title":"Measuring Cross-Modal Synergy: A Benchmark for VLM Explainability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T06:05:34.039507Z"},"links":{"cited_paper":"/paper/2506.13060","citing_paper":"/paper/2605.22168"},"observation_digest":"sha256:17520241f00450d4722ea507086b043f0b8ed761612dced3056efe86bbd82c32","observation_id":"e959f135-5479-437f-8687-0b2463a80929","resolution":{"observed_at":"2026-05-22T06:06:08.728672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"cited_work":{"arxiv_id":"2506.13060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13060","snapshot_observed_at":"2026-07-02T01:56:27.425584Z","title":"Rethinking explainability in the era of multimodal ai","venue":null,"work_id":"f0227c3b-9bef-40cf-b638-259729eec6e7","year":2025},"citing_paper":{"arxiv_id":"2606.03712","last_updated":"2026-06-02T14:34:01Z","snapshot_observed_at":"2026-08-04T19:48:56.728719Z","submitted_at":"2026-06-02T14:34:01Z","title":"When Graph Tokens Sink: A Mechanistic Analysis of Graph Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T11:27:09.779776Z"},"links":{"cited_paper":"/paper/2506.13060","citing_paper":"/paper/2606.03712"},"observation_digest":"sha256:c72e60d73f60e686c8971bfe43679a5c6236e9762f408cc8afad7637a4d7a3bd","observation_id":"7fa8a946-a63e-4618-b93c-fd9082e53411","resolution":{"observed_at":"2026-07-02T01:56:27.435247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13060","snapshot_observed_at":"2026-07-14T07:04:04.812401Z","title":"Rethinking explainability in the era of multimodal ai,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11102","last_updated":"2026-07-13T05:19:36Z","snapshot_observed_at":"2026-08-03T13:24:55.352714Z","submitted_at":"2026-07-13T05:19:36Z","title":"CHARM: Charge Calibration and Acoustic Rescue for LLM-based Multimodal Sarcasm Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T07:04:04.812401Z"},"links":{"cited_paper":"/paper/2506.13060","citing_paper":"/paper/2607.11102"},"observation_digest":"sha256:5dcfe0400a84e14df45f12616a5099c3b62ea556d7e0edb0dd9483f16d516cd1","observation_id":"78325e5c-d441-4171-ba4c-b955b76fb338","resolution":{"observed_at":"2026-07-14T07:04:04.812401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13060/citation-record","integrity":"/paper/2506.13060/integrity","json":"/paper/2506.13060/citation-record.json","paper":"/paper/2506.13060"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.659316Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":"ae1ab7ee-8f78-4ed1-9998-e096a816c38d","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.259576Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:fcc32d90b9d5fc2644d843eaf45d3e21a634893f54a916dabf2948642936dc41","observation_id":"3af1c08a-96a0-4a21-a3c9-502787544d37","resolution":{"observed_at":"2026-08-07T00:42:29.662053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.651514Z","title":"Explaining image classifiers by removing input features using generative models","venue":null,"work_id":"7ebf4006-3a84-4918-ad8c-05d3df8509b0","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.303733Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:dfa4cb0de889049f7dbcae64e8623438fe736a37620ab15e7e562b509b881f45","observation_id":"e9e195e2-7211-4c68-b92a-70e74d175dd7","resolution":{"observed_at":"2026-08-07T00:42:29.654111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.643296Z","title":"Rethinking stability for attribution-based explanations","venue":null,"work_id":"1fb66370-45f2-4b86-ae4d-5fac3cb6eb81","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.367380Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:6694c29c5393ca3870a5610be843a1c31b47a6bd2c0cfbfb01d056ab2aa6d4a1","observation_id":"984070d2-2f36-4156-8336-e40bc6dbc97f","resolution":{"observed_at":"2026-08-07T00:42:29.646503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.634833Z","title":"Openxai: Towards a transparent evaluation of model explanations","venue":null,"work_id":"88e68bc5-f0df-414f-b18a-567aea5a209b","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.439224Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:06229e45d514750532238d8f94a308177596e9f2eff49be26deab457c2b05031","observation_id":"dac50e95-3d98-4e19-9891-d72c32325bb1","resolution":{"observed_at":"2026-08-07T00:42:29.637512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.626460Z","title":"Probing gnn explainers: A rigorous theoretical and empirical analysis of gnn explanation methods","venue":null,"work_id":"417cb3bd-911f-4794-b133-117942aa2bb9","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.504216Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:40a2ffea89959e0cd9aaf9f239b83bad22022caf5055fbbca3ec754288533e64","observation_id":"ba26f6be-8964-426e-ac0a-ff778ea3e087","resolution":{"observed_at":"2026-08-07T00:42:29.629456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.618461Z","title":"Evaluating explainability for graph neural networks","venue":null,"work_id":"ea1cfb19-08f8-4e81-a3df-527a77f8b675","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.571972Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:3a202ca7b13892d9d5a6c346469e4a81f2302e77a36631f1626c358c68ef4840","observation_id":"0d929ea4-407b-42d5-b2ee-e84abde6576f","resolution":{"observed_at":"2026-08-07T00:42:29.621237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.610945Z","title":"Faithfulness vs","venue":null,"work_id":"8ab54f84-502c-466f-a4ac-621d1c56f10c","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.626366Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:db59b58790d6bdc99b293034d0a131b1c4bbbe70f54acc7264f30b77763e4416","observation_id":"68a648b3-10ac-47c0-9a67-1d34044f88a8","resolution":{"observed_at":"2026-08-07T00:42:29.613439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.602430Z","title":"On the robustness of interpretability methods","venue":null,"work_id":"152b9d50-75db-425d-8cf4-7173cd49913f","year":2018},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.686232Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:c24aa47334efaf0b5ef6ab56cbc5ef3c829de7816c685b82684cf6a0a743d564","observation_id":"e80cc26b-6ede-4b8c-b393-ea0cbb901c9f","resolution":{"observed_at":"2026-08-07T00:42:29.605272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:26.788163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.788163Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:7574eeba64ce74ff0b164e54e90b267a4fb92bbe4a22eba826cd1000bd8edb0d","observation_id":"2bfe0cc6-178d-49d3-830a-23b811035518","resolution":{"observed_at":"2026-08-07T00:42:26.788163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:26.837211Z","title":"Bottom-up and top-down attention for image captioning and visual question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.837211Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:17b677bcac72c2a397e6ab507fe141baef24957c48d4e23af6a48bc3adcfb251","observation_id":"b30ca549-e23c-44cd-b4d1-2a5e5bf906ef","resolution":{"observed_at":"2026-08-07T00:42:26.837211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.583586Z","title":"Mechanistic interpretability for ai safety--a review","venue":null,"work_id":"070d1459-76a4-4ae7-91ad-8285e09f87a1","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.841808Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:f6ce57a80ff8dbf47bdf4bd034856b47348d34e5cd336cf9c5e9541e2ba83606","observation_id":"8b72fe31-4c9f-41bd-a6f8-07b01590d325","resolution":{"observed_at":"2026-08-07T00:42:29.586577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.576120Z","title":"Interpreting clip with sparse linear concept embeddings (splice)","venue":null,"work_id":"af16c958-4062-47db-aad3-d616095a7bc0","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:26.932780Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:68366ab7a447cd31d32ab6c0396053bae1610429fab33ec570e507c61e31ccdf","observation_id":"e9b0ca62-89ea-4dad-96fa-822135289895","resolution":{"observed_at":"2026-08-07T00:42:29.578548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.567641Z","title":"A systematic review of natural language processing applied to radiology reports","venue":null,"work_id":"10c393e4-ef24-411f-ae40-37b678c60ddd","year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.061666Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:bf02253837128a0c3989898efc062368fb49b48ea5a1e1bd78b13bfd2773d095","observation_id":"9330670c-f551-4adf-8165-41ac0533e532","resolution":{"observed_at":"2026-08-07T00:42:29.570777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.558658Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech","venue":null,"work_id":"db7d5dde-6d6c-4274-bac6-3fd42381c5a4","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.132449Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:3fc8da3b76f75900ae5eb0db30a993ad4c991aeff1ca196692901aacd8c40fe8","observation_id":"71c8d4e4-7cbe-4f11-8b8a-63ddd07767e2","resolution":{"observed_at":"2026-08-07T00:42:29.562133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.549306Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":"fbd6c016-4994-4843-bd9a-cb727b93b6e2","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.333489Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:ebfa15f529249d4abb297f29d8a40b619a44bc7041e69db422a169872fda47ed","observation_id":"ff5ae73b-a5ee-420c-80b2-f58a98d2e890","resolution":{"observed_at":"2026-08-07T00:42:29.552564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.541067Z","title":"A survey of the state of explainable AI for natural language processing","venue":null,"work_id":"d334d187-8d70-4a95-8b2b-bcf3b85d1f6d","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.527518Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:375c6812276820fb6324a6119ce441b683191ed334a21d566f359f4c8c590a6d","observation_id":"b83aca68-c528-4830-a315-44dc01d2732c","resolution":{"observed_at":"2026-08-07T00:42:29.543988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.532139Z","title":"Interpretable explanations of black boxes by meaningful perturbation","venue":null,"work_id":"9725bd09-926c-4f03-b239-a31f0be4e8e6","year":2017},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.657416Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:2482b128b0cd5ef75debc19ac0812a0fc36212c28bfe1a1779e0db68bda82d32","observation_id":"5c4b732f-1d9d-44a5-a94e-5e23da05d5cc","resolution":{"observed_at":"2026-08-07T00:42:29.535889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.523353Z","title":"Attention in natural language processing","venue":null,"work_id":"bbdf0a5a-cc05-4665-bbce-f99615d75f79","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.763279Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:3a8b59ac31baed477c2627326eeca86ed28a3fe8b30bb2c3691dd7e795209ba9","observation_id":"dd7c68a8-f836-4f07-8ee9-9d1bc5b81bec","resolution":{"observed_at":"2026-08-07T00:42:29.526672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:27.877776Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:27.877776Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:afa6e28602807d15dcc7864b14b0b9a1b00c7e9915d714480e24c02942f1d749","observation_id":"2a22c5e4-73e5-4af5-8ac1-aa13a8c52e87","resolution":{"observed_at":"2026-08-07T00:42:27.877776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:28.022494Z","title":"Multimodal neurons in artificial neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.022494Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:4a88dd9a5ec58cc9ce1978842c634583c14163ad5480a499a66ac9699d409c01","observation_id":"73110066-299b-41a0-a5ba-3a79da32cd2b","resolution":{"observed_at":"2026-08-07T00:42:28.022494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.510348Z","title":"Localizing model behavior with path patching","venue":null,"work_id":"0cdd79d3-268e-4138-8d25-42952352b816","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.128344Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:84df7f842b44e97e9c24f5a68cd83dff298e5e69840060c036e2e3cbc502d99a","observation_id":"01ec86a9-f872-4637-8b6e-28f5d28e6f45","resolution":{"observed_at":"2026-08-07T00:42:29.513201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.502573Z","title":"circuit-tracer","venue":null,"work_id":"63ad9cf8-6ad9-411f-bce9-fbea4a3e9524","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.269781Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:577adee2f27458cba896962e89a186425dba4fc7ba8cb1243d112f0f64e3a854","observation_id":"58b5f494-cf54-4156-b688-bddedc945355","resolution":{"observed_at":"2026-08-07T00:42:29.505128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.494451Z","title":"Sparse autoencoders can interpret randomly initialized transformers","venue":null,"work_id":"5ffd2a88-1d02-4bb5-a444-47abaa3c1f36","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.416595Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:1f78e2a5d3d91ddf766a32738492f2944f096a0f3c71402b2718951b5df43afe","observation_id":"53e35e70-3a07-4041-b1ee-a02db5051133","resolution":{"observed_at":"2026-08-07T00:42:29.497397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.486276Z","title":"How to use and interpret activation patching","venue":null,"work_id":"f99e70db-eac1-47a9-9089-e0d7dc0ad76d","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.463677Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:eb65ed92610325fbfea39e632842036034f7bf22626adf15a86ca4ccda3ddecf","observation_id":"27fa1c05-ccfb-4f74-8987-727c3b9967ea","resolution":{"observed_at":"2026-08-07T00:42:29.488734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.478581Z","title":"Gpt-4o system card","venue":null,"work_id":"c11077c1-3c67-436f-b963-88546bea1b36","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.556321Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:a393429c2ced452083e0bd283396938b489945fd7759d2365f4316dcd0a381e2","observation_id":"8e6f692f-2762-40d5-ae90-1f88b12c21d3","resolution":{"observed_at":"2026-08-07T00:42:29.481319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.470802Z","title":"Attention is not explanation","venue":null,"work_id":"c46d7c2c-7d67-4178-a3ac-e0f7c8b9dfda","year":2019},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.725792Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:000068476ab8b314b664c1b77f623b90a35919df042de39991bbe59e9211224c","observation_id":"f0aa6866-6edb-45d1-8aac-b804a1dcec0c","resolution":{"observed_at":"2026-08-07T00:42:29.473645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.462310Z","title":"Towards better explanations of class activation mapping","venue":null,"work_id":"6d78b94e-2c2e-4c7a-ac6b-3fc8bc0128c0","year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.798199Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:805a3e4afd26dc43efa15306c7d53cc0a1810047964620645c970a1f6b6871cd","observation_id":"e97b0d30-c973-4b55-97ee-35d444b68328","resolution":{"observed_at":"2026-08-07T00:42:29.465422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.453855Z","title":"See what you are told: Visual attention sink in large multimodal models","venue":null,"work_id":"2416e7fe-7b4a-44a0-98a3-d6961c51eec6","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.900844Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:e34473c2c647d71b1c3e68fbf12a49ee01e45652443e7dab7f470eca451a81bd","observation_id":"1658005b-6abd-4e3c-b28c-f6c0d9339249","resolution":{"observed_at":"2026-08-07T00:42:29.456805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.445501Z","title":"Are sparse autoencoders useful? a case study in sparse probing","venue":null,"work_id":"accbdef0-7e40-45c3-9fad-a6a7ebbecb3b","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.903792Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:1ef512c70ae1984e7238ed65e5441fdb74372bab97e6688f3c4d798c47ee85d3","observation_id":"b55d8e19-e710-4b8d-b0eb-24b3e9c61569","resolution":{"observed_at":"2026-08-07T00:42:29.448113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.437426Z","title":"Interpretability beyond feature attribution: Quantitative testing with concept activation vectors (tcav)","venue":null,"work_id":"fde87ae7-54e0-4fd4-b343-52f6b0e2369f","year":2018},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.907513Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:2e1490df5ea8dab1ddb6e19963c72ba3dfdaad8073c857d1fc9dacd2b50d0805","observation_id":"76fd0b06-a54c-44fd-9a18-11a8cf2a2735","resolution":{"observed_at":"2026-08-07T00:42:29.440079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.429200Z","title":"Visual explanations from hadamard product in multimodal deep networks","venue":null,"work_id":"2fa32d76-b7fc-46d0-8e89-0714696039b2","year":2017},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.910613Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:7102400e7547ebc65ee51dca4321981be9a056e682bd265b5a608c87c53f413e","observation_id":"a232f5b8-1e45-4dac-84d1-b0de4c5a8ee9","resolution":{"observed_at":"2026-08-07T00:42:29.432182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.421142Z","title":"Sparse autoencoders work on attention layer outputs","venue":null,"work_id":"46ba0de0-daca-45dd-9d47-03c3a56cdbcd","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.913186Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:20e313c8c0c59c8563a975b6a5735484fcf1e649c4b43744c6a6c515d855cb72","observation_id":"2663b66b-3d31-4647-8e56-29db4b1ea64f","resolution":{"observed_at":"2026-08-07T00:42:29.423738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.412748Z","title":"Concept bottleneck models","venue":null,"work_id":"df7cb3c4-0ba6-4496-964d-cd36b0fa7620","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.915947Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:57d03be724cbae9e2e6983fb6cec644684544fde846f694cdbeb8134fcf9c5c9","observation_id":"fc111ff6-7041-490a-8150-c998f73b5d88","resolution":{"observed_at":"2026-08-07T00:42:29.415774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:28.919086Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.919086Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:0d4d2725bed62d4b327d59eff017b71af174ab994939e654227f6634895b7a8c","observation_id":"d31aee84-5f77-4372-9004-bce8dda6e587","resolution":{"observed_at":"2026-08-07T00:42:28.919086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.396508Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innovation, 2025","venue":null,"work_id":"9d46ab3d-4978-48f4-aac4-b8abf8de395c","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.922026Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:65d8ed945ac31e7732aa42a297810a532846c4705801130254ca76136c68218f","observation_id":"bd86b7aa-387b-4539-ae63-b27b6d14e43f","resolution":{"observed_at":"2026-08-07T00:42:29.400086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.387312Z","title":"Dime: Fine-grained interpretations of multimodal models via disentangled local explanations","venue":null,"work_id":"06816396-1ade-47ef-9cdf-e8b7065c6d19","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.924634Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:2e1ceddf1b86be03e75904e8c13bcca06d17c31cd6aa2da814a373fa56c4441b","observation_id":"6d72c13d-9cff-4836-9bb7-9c180aaa53c7","resolution":{"observed_at":"2026-08-07T00:42:29.390166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.378265Z","title":"Towards principled evaluations of sparse autoencoders for interpretability and control","venue":null,"work_id":"b30a2476-00f4-4ac7-8fa0-601d559025c5","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.927165Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:48364325e683ae7d069c95fbe25da972ab2c4ad38d73b3b1d6c55c8996ca71c6","observation_id":"10a7cc3b-7dee-47f0-864b-c2bffc8d1be5","resolution":{"observed_at":"2026-08-07T00:42:29.381270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.369218Z","title":"K-sparse autoencoders","venue":null,"work_id":"0c806f62-05c6-4309-8697-a59b8aa6b557","year":2013},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.930060Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:4aa9c111633ee575381b8408687bf48b2543e7b9803b6598074180be8aa4bb9b","observation_id":"09701853-acbf-4520-982b-17a8998c66c5","resolution":{"observed_at":"2026-08-07T00:42:29.372416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18738/t8/huig48","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Cora Dataset , 2017","venue":"Texas Digital Library (University of Texas)","work_id":"dd2c09b6-d9e5-498c-bb4e-0418c7ff1ff7","year":2017},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.932484Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:e93e1918fec748c1953e46de89fb7fa011ec437fd0c8aab5c5f93b6b389f8da2","observation_id":"d948b4a3-5d6f-45b6-97ac-3399c09cfbb4","resolution":{"observed_at":"2026-08-07T00:42:29.058540Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.360514Z","title":"Dual attention networks for multimodal reasoning and matching","venue":null,"work_id":"64e434e6-0573-4fc3-b33b-f8f60e964159","year":2017},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.936030Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:30205c5084505e2ebb950c0a1274dfb4ed485743412df97e15f829bcb5754f70","observation_id":"6ad8b818-4dd1-44e7-956b-8b5643d31e81","resolution":{"observed_at":"2026-08-07T00:42:29.363261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.351546Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"3e3ac8c3-bc95-404a-9a83-44a71044a3a8","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.938997Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:7bafb6db804a35fbc20c5b900fdfe69a040b748ed59a167891de1e7f0631e344","observation_id":"dc8897a5-a6b7-42bc-9794-ba6034848c7b","resolution":{"observed_at":"2026-08-07T00:42:29.354495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.342557Z","title":"Towards interpreting visual information processing in vision-language models","venue":null,"work_id":"e2efe3bd-845e-42d4-8570-f3004e9daff6","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.942127Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:2f665ec5572298b93d4bc40534168b1437a3bd9876d61d7a867fc2f14c3961fa","observation_id":"79cae0d2-f3bc-4e66-be53-19e694b72264","resolution":{"observed_at":"2026-08-07T00:42:29.345637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.329750Z","title":"Interpreting gpt: the logit lens — lesswrong, 2020","venue":null,"work_id":"e85b5c59-04e6-4a39-82ee-bb45a334a658","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.945456Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:bf596206804cfea0418a00b9641bf8d14ec1ebc72e399ccd9992a447dacc9558","observation_id":"c7cbc69e-bf5e-4747-93c9-94786e7f064e","resolution":{"observed_at":"2026-08-07T00:42:29.336016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.320080Z","title":"Sparse autoencoders enable scalable and reliable circuit identification in language models","venue":null,"work_id":"f37ce9cc-ea2c-4b42-bcb8-6e37f613b1a4","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.948326Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:a39bd38995e87f3c1ed73076ce00f260ac3d89906d4fac00e1b7229aebd82310","observation_id":"d715bbb6-fe3d-4db6-a41c-bd1bd4ebd834","resolution":{"observed_at":"2026-08-07T00:42:29.323328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.309663Z","title":"Orchestrating explainable artificial intelligence for multimodal and longitudinal data in medical imaging","venue":null,"work_id":"351cef09-4461-4642-874d-b306d44b29cd","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.951649Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:497d53286525df6c7d2a5f3b813f98cba3a5790248f4589e876e94b419cc9482","observation_id":"2c07b905-63f8-44ea-a47f-6437fd125a97","resolution":{"observed_at":"2026-08-07T00:42:29.313186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.299740Z","title":"Multimodal explanations: Justifying decisions and pointing to the evidence","venue":null,"work_id":"fe8f0b64-08e8-4280-975f-e84c77ce38da","year":2018},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.954808Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:ee304d9e70a98e36f0d4a165399150ab1d0821e93314b294e275de8de0b8672f","observation_id":"4800466b-dc2d-4089-a996-e299c028f495","resolution":{"observed_at":"2026-08-07T00:42:29.303136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.290194Z","title":"Perception test: A diagnostic benchmark for multimodal video models","venue":null,"work_id":"a6c7ce0a-835e-4ce0-98db-f19d4491dde4","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.958203Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:27df528216a6d6b6e4ac808ba695ba3227ab51ac0feb7e85cf4cc3072ca7d64a","observation_id":"4090a390-ff36-49e6-b878-5d2e5f2043e3","resolution":{"observed_at":"2026-08-07T00:42:29.293361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.280565Z","title":"why should i trust you?","venue":null,"work_id":"f98b4f2d-3005-4f6f-8187-8523739db309","year":2016},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.961538Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:e659ae314c7a713f72fdabaa507be3852c38c13752e1f0477bef477f6f92cbf5","observation_id":"5710ee75-fc3d-4db1-b004-49210df59698","resolution":{"observed_at":"2026-08-07T00:42:29.283504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.269641Z","title":"Multimodal explainable artificial intelligence: A comprehensive review of methodological advances and future research directions","venue":null,"work_id":"42a6a090-995a-4e79-8fe7-b8cc53afeacc","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.964598Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:4eb705ee689d323ec01252f6e511873cacfe2f34ba483495599f3d0c57e616c8","observation_id":"04b749df-81b9-485d-8747-39cd821ff174","resolution":{"observed_at":"2026-08-07T00:42:29.273333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.258925Z","title":"Grad-cam: visual explanations from deep networks via gradient-based localization","venue":null,"work_id":"b0043e1e-5bca-44e7-a654-6b555a324853","year":2020},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.967477Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:893fc12c8fde002a01fe6ea251ce7196978e60d27df665d0eba820c2885a0e01","observation_id":"4a8f4d6c-f88d-40cb-9d4a-19ca03f09474","resolution":{"observed_at":"2026-08-07T00:42:29.262818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.247480Z","title":"Towards a systematic evaluation of hallucinations in large-vision language models, 2025","venue":null,"work_id":"b1e0cfa8-6921-4a24-87d8-d4afe931f33a","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.970368Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:e61eca02632f4b90135ccd8725d44d40db7b07b7f1ab6a5cc8c11422865ea12e","observation_id":"d47a6440-9889-4321-bc0f-404e956b03d2","resolution":{"observed_at":"2026-08-07T00:42:29.251109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.237192Z","title":"A survey on sparse autoencoders: Interpreting the internal mechanisms of large language models","venue":null,"work_id":"75811cfd-ac19-401c-b37d-4402652641d5","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.973187Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:e94e6dd43cecc8cb1b663f840b8b60dec2d1fc0b08fcddb2323d46269f82fd9a","observation_id":"f7a6c207-7c7d-489a-85ba-61204051517d","resolution":{"observed_at":"2026-08-07T00:42:29.240739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.224840Z","title":"Explain and improve: Lrp-inference fine-tuning for image captioning models","venue":null,"work_id":"19f91962-73b8-4186-8dbe-33fcae1f7d49","year":2022},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.976734Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:ce46d13780a33001e4b53490763f5dbe50c0281b35e0897a0140a8e8d378f128","observation_id":"a04aec4a-c21a-4f5a-9ffe-21c92752d966","resolution":{"observed_at":"2026-08-07T00:42:29.228568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.215160Z","title":"A review of multimodal explainable artificial intelligence: Past, present and future","venue":null,"work_id":"0bf9e260-671a-4c17-a7ba-eec5fbb94ece","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.979987Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:7dac5a1e39d357852866ed1cabdada881e8d0e2c91b23bbebfc458ab4891a7f7","observation_id":"db11ca8e-3712-45e5-9120-7b91e1f67191","resolution":{"observed_at":"2026-08-07T00:42:29.218446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:28.983629Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.983629Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:6b164d4cb414124a23ceb4d98c0887faa02937972c9ead9dad965b430b39dfb6","observation_id":"9478184d-e968-46cf-8c69-23d1654c5cef","resolution":{"observed_at":"2026-08-07T00:42:28.983629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.198669Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":"50f7a37f-6f30-45f5-921b-d720cf6467d3","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.986797Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:555cfa4333e8b3d85f5e515bb31b08b37bc4bb6f226a9e7bd8c5783b6937a3b6","observation_id":"127be7d0-9987-4a6a-9cd6-4d50222b2310","resolution":{"observed_at":"2026-08-07T00:42:29.202394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.189340Z","title":"true features","venue":null,"work_id":"484e94c1-8312-4ce1-b924-cae7a287448c","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.989644Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:55c94107383ebf1f283b0784406767bd27b73086997ff27e1a3adee70b0e75c8","observation_id":"a4423586-1adb-4559-a1aa-cd6104720e8d","resolution":{"observed_at":"2026-08-07T00:42:29.192345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.179412Z","title":"Interpretable multi-modal hate speech detection","venue":null,"work_id":"81416b7b-54b0-4c03-a2ed-f0aa1e39e154","year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.992562Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:3e4529de6d12e46f45f8c84ba4994a1557bfae26a31c1612f8410904f0a0f199","observation_id":"26f833ad-74c0-4781-a7ba-d512b5e24463","resolution":{"observed_at":"2026-08-07T00:42:29.182634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.168858Z","title":"Llms as zero-shot graph learners: Alignment of gnn representations with llm token embeddings","venue":null,"work_id":"21eed0d2-a1c9-4277-93be-45562e3fb76f","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.996067Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:c393e0a2a535a439ad9e3ed80fe9ae8eb3f657f1ad7b2e2912d7e8435c40612f","observation_id":"13d2d4eb-e3db-46fa-b42e-579c28644c3d","resolution":{"observed_at":"2026-08-07T00:42:29.172041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.159593Z","title":"Interpretability-based multimodal convolutional neural networks for skin lesion diagnosis","venue":null,"work_id":"4a074df3-38fd-4a19-906c-92b61302112a","year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:28.999392Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:85d1dc6e80f71802c77921ac1743919ac8de19bf13d88f22595321bf1223ee03","observation_id":"c4f7bf7a-9a19-401a-ad58-5cfb88c2a18e","resolution":{"observed_at":"2026-08-07T00:42:29.162541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.149887Z","title":"M2lens: Visualizing and explaining multimodal models for sentiment analysis","venue":null,"work_id":"bd6e8dd9-2bc9-4549-bed9-dd100f633eca","year":2021},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.003369Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:bc3a57158650e3b293fdae2cdb6d41d712d9f9c1d7f4ee0cf673529780c430d8","observation_id":"42b9148e-0952-4fb0-ae29-825dcfbe4189","resolution":{"observed_at":"2026-08-07T00:42:29.153262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.140343Z","title":"Logitlens4llms: Extending logit lens analysis to modern large language models","venue":null,"work_id":"174bb584-2ee4-4f62-abf2-f19d4039e0e6","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.006356Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:327a3d62706f025bcfd34fe65c54b6fc4c7d452475036e822faa512e3a49092e","observation_id":"ebc623f6-6642-4b47-9c22-8659859ed20f","resolution":{"observed_at":"2026-08-07T00:42:29.143582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.130051Z","title":"Measuring cross-modal interactions in multimodal models","venue":null,"work_id":"4c04e27e-7f74-483f-be56-b7964a12acf5","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.009655Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:08653208f203756ff69698447366ccda4e77c60081abf5f75853e7f004e4cf1a","observation_id":"9bbe7916-e983-4faf-8c4e-eee4039a93e8","resolution":{"observed_at":"2026-08-07T00:42:29.133461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.012981Z","title":"Attention is not not explanation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.012981Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:f4dea997afc386721a1f9ad8f682861d984e79a23e911893110901a56778807e","observation_id":"a6605486-fd69-4385-8619-8359b4bcf3e8","resolution":{"observed_at":"2026-08-07T00:42:29.012981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.113064Z","title":"Audio-text models do not yet leverage natural language","venue":null,"work_id":"5992835c-6fb6-458d-8ec1-0b2dc1fd236b","year":2023},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.016404Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:1932036492a260fd71520a5bc5f2990dfb178925b0f1c6019a9b5d38b0689914","observation_id":"bfc1f85b-657c-45ed-bdd8-e0d36f5b9e19","resolution":{"observed_at":"2026-08-07T00:42:29.116161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.103666Z","title":"Visual entailment: A novel task for fine-grained image understanding","venue":null,"work_id":"38dd74d1-f8a7-459a-a34b-089a922f1c9b","year":2019},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.019748Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:2b89902401462e0213996c317b44af6678d5bc6118f48100dfdd858334a265fa","observation_id":"0872db54-30ab-424c-bda3-b1f90a1b4014","resolution":{"observed_at":"2026-08-07T00:42:29.106824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.093845Z","title":"Gnnexplainer: Generating explanations for graph neural networks","venue":null,"work_id":"fdd1c4b2-54a5-484c-86e3-03a07715cebc","year":2019},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.022997Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:9c874785636a3dbee4642a14733beeb5aedac4f49fffed77b9aa4418ba6fc762","observation_id":"09e3969f-c253-407b-9aa3-6b7149e17005","resolution":{"observed_at":"2026-08-07T00:42:29.097057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.083992Z","title":"Towards best practices of activation patching in language models: Metrics and methods","venue":null,"work_id":"9436c9ad-8e06-44b8-86ce-18698634aa6a","year":2024},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.026082Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:9099628749c182ffba7f15e83a5d29c56f4e1b513877db9f18f1920516e66b6e","observation_id":"1f6d3cff-855f-42a1-9d6c-3a80b1249434","resolution":{"observed_at":"2026-08-07T00:42:29.087636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:29.072556Z","title":"Vlm ^ 2 -bench: A closer look at how well vlms implicitly link explicit matching visual cues","venue":null,"work_id":"442b2f13-4f44-44c1-81a1-afa17d271ec1","year":2025},"citing_paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T00:42:29.029561Z"},"links":{"citing_paper":"/paper/2506.13060"},"observation_digest":"sha256:27ed4ffdefda81334c16e5297726474454e1041625101219a70c3865f1a22ff6","observation_id":"595c6cf6-5b44-4e92-9567-798b5846efc9","resolution":{"observed_at":"2026-08-07T00:42:29.076856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13060","last_updated":"2025-06-16T03:08:29Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T03:33:41.268003Z","submitted_at":"2025-06-16T03:08:29Z","title":"Rethinking Explainability in the Era of Multimodal AI"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":61},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 5 inbound Pith citation observations for arXiv:2506.13060."}