{"as_of":"2026-08-10T08:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d8900148fa29a13b021a9a053774f64f89dbe9e2689289035b785a30daa660c6","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T04:27:07.932164Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00076/citation-record","integrity":"/paper/2608.00076/integrity","json":"/paper/2608.00076/citation-record.json","paper":"/paper/2608.00076"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02104","last_updated":"2024-12-03T02:54:31Z","snapshot_observed_at":"2026-07-06T20:00:37.331726Z","submitted_at":"2024-12-03T02:54:31Z","title":"Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02104","snapshot_observed_at":"2026-08-05T04:27:07.859701Z","title":"arXiv preprint arXiv:2412.02104","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.859701Z"},"links":{"cited_paper":"/paper/2412.02104","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:930596bffcd8f9e291fefc7e2dfd87e59077012e0cbcf742f90d609fedae50fa","observation_id":"763be5cb-b83e-42dd-b839-0eec196a34bc","resolution":{"observed_at":"2026-08-05T04:27:07.859701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-05T04:27:07.873902Z","title":"Gemma Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.873902Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:b4e93adee565c2819da866cd51bf916da208903940b9fa355fd7cda922a5e36d","observation_id":"533b991b-3549-47f0-a4c1-e19abfba5d97","resolution":{"observed_at":"2026-08-05T04:27:07.873902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T04:27:07.878610Z","title":"Guidotti, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.878610Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:d3ca1f2fe84ff7ff20f6881074815c1d42f11e2d9909d7e4ebf76fda5bef0099","observation_id":"43999eea-21ba-4444-a1f3-9e3f479c38f4","resolution":{"observed_at":"2026-08-05T04:27:07.878610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:07.887351Z","title":"InAdvances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.887351Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:8591743b29e8a3fa5a37b7dfbfe2565557b6ce0cb917fe2220963f60f177eb1b","observation_id":"a638ba08-b008-4e45-87ab-a74c56ca15a9","resolution":{"observed_at":"2026-08-05T04:27:07.887351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17516","last_updated":"2025-02-22T20:55:26Z","snapshot_observed_at":"2026-08-08T10:56:10.786814Z","submitted_at":"2025-02-22T20:55:26Z","title":"A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17516","snapshot_observed_at":"2026-08-05T04:27:07.900572Z","title":"Lou, H.; Li, C.; Ji, J.; and Yang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.900572Z"},"links":{"cited_paper":"/paper/2502.17516","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:dcef18a4d0b9a9d96519dd75a9c317fafdbcf7f5ccfa99ddddff3dd4db149016","observation_id":"5fabadee-bab1-4deb-b1f7-f996f485bf3d","resolution":{"observed_at":"2026-08-05T04:27:07.900572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.04463","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.156843Z","title":"InInternationalConferenceonLearningRepresen- tations","venue":null,"work_id":"dbecc324-f132-4dad-9e0e-e61df383f9fc","year":2025},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.904960Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:7f5b35f4357124df8d9d485511df42ff049282cbee080eb4f09935deea4051f2","observation_id":"4cf2a745-dc56-4910-8009-2254c7877323","resolution":{"observed_at":"2026-08-05T04:27:08.166338Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T04:27:07.909756Z","title":"Olson, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.909756Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:160dba840d5366178a7b895c051c143578a4581e3d0d03a27f332373baf22ce1","observation_id":"cd758f7f-cab3-439e-87f9-aaedb6340716","resolution":{"observed_at":"2026-08-05T04:27:07.909756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.482282Z","title":"In Findings of the Association for Computational Linguistics: ACL-IJCNLP 2021, 3094–3109","venue":null,"work_id":"6d030215-1c36-4d66-a21a-24c5021a5928","year":2021},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.914356Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:f4b2c2206b0fddb8f1298a2d8bb243fa7870a02387dfd210506f365a4258a3d8","observation_id":"eef559a7-abdc-4616-a01f-380a6caba14e","resolution":{"observed_at":"2026-08-05T04:27:08.487052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.467892Z","title":"InProceedingsoftheIEEEinternationalconferenceoncom- puter vision, 618–626","venue":null,"work_id":"18cd92a0-2307-462a-a1f0-84bb4d8ed5ca","year":1953},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.918450Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:416095c88dbcc905791b2142001f9313f61bcfbd32832dcc3988d56098e14602","observation_id":"eeda113e-4b51-41e4-a186-0a82c6edc4c5","resolution":{"observed_at":"2026-08-05T04:27:08.472247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20316","last_updated":"2025-05-23T02:25:26Z","snapshot_observed_at":"2026-08-08T08:33:09.022524Z","submitted_at":"2025-05-23T02:25:26Z","title":"Reinforcement Speculative Decoding for Fast Ranking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20316","snapshot_observed_at":"2026-08-05T04:27:07.923007Z","title":"Soenksen, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.923007Z"},"links":{"cited_paper":"/paper/2505.20316","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:3ccf830ba149cae43dfa84b1bd1bf9285164f337505dc45e8da3dc4f390a54bf","observation_id":"157a78b3-e3a3-4441-80ae-23fa8c7516c5","resolution":{"observed_at":"2026-08-05T04:27:07.923007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.454569Z","title":"InEuropean Conference on Computer Vision, 351–368","venue":null,"work_id":"ccbcc57e-a7bc-44b5-8f8d-573f43271255","year":2021},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.927782Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:17d58864d0b45b67bc450cd56a25f9bef36efb6e70ec3ff0c4300f1a194148f7","observation_id":"e81b727f-a8c1-4181-98fc-42da1c784f7b","resolution":{"observed_at":"2026-08-05T04:27:08.458802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.496454Z","title":"Omni-Diffusion:UnifiedMulti- modal Understanding and Generation with Masked Discrete Diffusion","venue":null,"work_id":"5bc4a322-b69c-43da-985a-845d28bc6c71","year":2026},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":565,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.891568Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:f3ffc5e8d66a694d3311aceb94de381fd98a086a818cccbe1534419562531268","observation_id":"addf7ff3-0ed8-47a6-a314-9b7ca3f86ec3","resolution":{"observed_at":"2026-08-05T04:27:08.500842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.06104","last_updated":"2018-03-07T10:49:28Z","snapshot_observed_at":"2026-07-06T06:09:50.743518Z","submitted_at":"2017-11-16T14:19:29Z","title":"Towards better understanding of gradient-based attribution methods for Deep Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.06104","snapshot_observed_at":"2026-08-05T04:27:07.839040Z","title":"Asadi, M.; O’Sullivan, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.839040Z"},"links":{"cited_paper":"/paper/1711.06104","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:0c89ea6051297f6ec006acb90b94c7943ec3cc117384ab29d67694fb489a84cc","observation_id":"bf3f7145-7f23-4501-b08c-a652474b1488","resolution":{"observed_at":"2026-08-05T04:27:07.839040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.510914Z","title":"InAdvances in Neural Information Processing Systems, volume 33, 6840–6851","venue":null,"work_id":"e4308b17-fff8-40ca-bde5-7855aaa73b24","year":2022},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.883156Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:3f7ca3b45003ec7b1e153627743f9f7af9e263d73a70fd8375adefd67be327b2","observation_id":"f8e2ba72-8dc2-449a-a8a2-61d4bdf6684c","resolution":{"observed_at":"2026-08-05T04:27:08.516628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.527167Z","title":"Dunefsky,J.;Chlenski,P.;andNanda,N.2024","venue":null,"work_id":"f5a35fcf-e57d-4d1f-bfde-1a0abb718803","year":2024},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.864624Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:eea5c2ec8bb7ebd8b8a64a86a4482aae7dc39da2473e8b11e5ad354a79f3c379","observation_id":"37aafc6d-bdcd-4a4d-a69d-886f47b19df9","resolution":{"observed_at":"2026-08-05T04:27:08.531488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00056","last_updated":"2023-03-06T19:39:18Z","snapshot_observed_at":"2026-07-06T13:26:38.135401Z","submitted_at":"2022-06-30T18:42:06Z","title":"MultiViz: Towards Visualizing and Understanding Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00056","snapshot_observed_at":"2026-08-05T04:27:07.895794Z","title":"arXiv preprint arXiv:2207.00056","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.895794Z"},"links":{"cited_paper":"/paper/2207.00056","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:9199c46b7cd91ad8fc9cf378ac7ea7783b33c2481bfcd99f4d933bf93497ff85","observation_id":"ac7d38a6-b6af-4b90-981e-0add59c5db18","resolution":{"observed_at":"2026-08-05T04:27:07.895794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17833","last_updated":"2024-07-12T06:53:50Z","snapshot_observed_at":"2026-08-10T08:11:17.716467Z","submitted_at":"2023-11-29T17:35:29Z","title":"DiG-IN: Diffusion Guidance for Investigating Networks -- Uncovering Classifier Differences Neuron Visualisations and Visual Counterfactual Explanations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17833","snapshot_observed_at":"2026-08-05T04:27:07.850124Z","title":"Ben Melech Stan, G.; Aflalo, E.; Bhatt, G.; Chen, S.-Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.850124Z"},"links":{"cited_paper":"/paper/2311.17833","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:2b6cc820ce3acedee996489ea949b2131ab5b39c84b55327dbda1a464e028145","observation_id":"8c5b0106-7aa3-425d-943d-315fe52526fe","resolution":{"observed_at":"2026-08-05T04:27:07.850124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.540591Z","title":"InIEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops, 8182–8187","venue":null,"work_id":"f3eb4356-cd30-4896-83c4-e29ac9df95de","year":2022},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.855179Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:46b718fb542e44e602f4c59ceb67d88882e4d3bc3dd870f149d722029f8c1e68","observation_id":"7cb0f611-6967-4e1a-b20d-b22eaf847959","resolution":{"observed_at":"2026-08-05T04:27:08.545118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.14067","last_updated":"2026-04-29T20:52:08Z","snapshot_observed_at":"2026-07-06T22:39:08.850289Z","submitted_at":"2025-12-16T04:12:17Z","title":"Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.14067","snapshot_observed_at":"2026-08-05T04:27:07.868952Z","title":"Gao, L.; la Tour, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.868952Z"},"links":{"cited_paper":"/paper/2512.14067","citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:89ef3bfed0aeb4963bf3e84b4be564c615ff4480e9e70e1df5368a96ccbcae3b","observation_id":"1cdf0d50-4b2b-4172-aa6a-4c552618b22c","resolution":{"observed_at":"2026-08-05T04:27:07.868952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:07.845272Z","title":"Augustin, M.; Boreiko, V.; Croce, F.; and Hein, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.845272Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:653e6f1050075104ff5f737468bb72e58b71e73ac40ffc2b564b4817a3505355","observation_id":"34eb97c3-f40d-4e7d-8f78-634be343d6f7","resolution":{"observed_at":"2026-08-05T04:27:07.845272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T04:27:08.439372Z","title":"InProceedings of the 64th Annual Meeting of the Asso- ciation for Computational Linguistics","venue":null,"work_id":"10f05f47-d103-4e45-9e60-891dec25ff8c","year":2026},"citing_paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs","version":2},"reference_index":6723,"source":"pdf_text","source_observed_at":"2026-08-05T04:27:07.932164Z"},"links":{"citing_paper":"/paper/2608.00076"},"observation_digest":"sha256:282f00955c075dba4fdc415904f39c4bc47e9e8239b054cae782d032a9da14c1","observation_id":"e4e40113-9cc2-48fe-9f84-7d9c6f0565e9","resolution":{"observed_at":"2026-08-05T04:27:08.444808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00076","last_updated":"2026-08-04T08:25:13Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T23:09:40.857736Z","submitted_at":"2026-07-29T13:33:11Z","title":"Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.00076."}