{"as_of":"2026-08-09T14:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4fc7d497ad7aa73100c8c954428ee4a4c34677eb0db764fe81dda575a70fde54","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:23:16.335985Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01979/citation-record","integrity":"/paper/2608.01979/integrity","json":"/paper/2608.01979/citation-record.json","paper":"/paper/2608.01979"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.208825Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.208825Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1cf7d5ee34b123c0ee4a178ac5fe6a76860609cd60a9365e50db50445998bd70","observation_id":"8f9e7c20-679b-4990-acc4-9dfa85b50310","resolution":{"observed_at":"2026-08-04T17:23:16.208825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.213246Z","title":"Scene Text Visual Question Answering , booktitle =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.213246Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:85971d0eef623e53deafba6dfb0776f5a0f1b91cb70104e7bd454d63f1e34404","observation_id":"902236a9-bb7f-4284-b18b-dd8197834550","resolution":{"observed_at":"2026-08-04T17:23:16.213246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.215998Z","title":"2024 , howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.215998Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:81bbeb058724711470947ce0786197eca5fea6d77f8d2a6a5da8a6139a2d3b1e","observation_id":"d58060be-1622-4ec4-9d08-57a113189909","resolution":{"observed_at":"2026-08-04T17:23:16.215998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.218563Z","title":"2019 International Conference on Document Analysis and Recognition (ICDAR) , pages =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.218563Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:7755e9bf2d37d6aebbaddc48b3ef3d19d789adbe4e523b5ee16b1fc96301000f","observation_id":"4a9290b9-0fb4-441d-9ce0-c111292a5b09","resolution":{"observed_at":"2026-08-04T17:23:16.218563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.221145Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.221145Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:d4c9e79e8ed9177077dc51d1ba159eafe961c6b9620dc2298676ff9b8e52f313","observation_id":"f71cb57c-2418-4be8-bd2f-f9b793d1fa09","resolution":{"observed_at":"2026-08-04T17:23:16.221145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.223733Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.223733Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f6cb7cc7392039002af01dfcb820c74d3bed6d920e988bfb41aaf3348cf9e982","observation_id":"00536d71-db08-43c7-b9c9-9d97b1c892fa","resolution":{"observed_at":"2026-08-04T17:23:16.223733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12309","last_updated":"2026-05-15T11:58:28Z","snapshot_observed_at":"2026-07-06T23:24:03.984179Z","submitted_at":"2026-05-12T15:56:22Z","title":"G$^2$TR: Generation-Guided Visual Token Reduction for Separate-Encoder Unified Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.12309","snapshot_observed_at":"2026-08-04T17:23:16.226474Z","title":"arXiv preprint arXiv:2605.12309 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.226474Z"},"links":{"cited_paper":"/paper/2605.12309","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:b2ff56c0d70afdc17425da90f0d90255e9074f6d4ccf7c0ffa6d8076c9b3ae34","observation_id":"f6b5f369-d12e-4297-b3e7-68f9c8070272","resolution":{"observed_at":"2026-08-04T17:23:16.226474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.229295Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.229295Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:215125bb8c926b8d30b134b1fc73540c821006b2263c04e6f21c0923a55e4bb0","observation_id":"009147b5-26c1-4b3b-a45b-a792df01a27e","resolution":{"observed_at":"2026-08-04T17:23:16.229295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.231673Z","title":"Findings of the Association for Computational Linguistics: ACL 2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.231673Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:c47724d8c52787c1f5a52b294b4d9364ccb5469845a6ff6f8a0bf5a1675c68e7","observation_id":"101befc7-c6f3-4d30-ac98-2129812b6496","resolution":{"observed_at":"2026-08-04T17:23:16.231673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.234091Z","title":"Computer Vision -- ECCV 2020 , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.234091Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:2ff179a0f1c7d9f335740c281635ca54e28cdb39489265a3292b4f5600c45136","observation_id":"37191fb7-bd59-421d-8d64-0cfcecf53cc3","resolution":{"observed_at":"2026-08-04T17:23:16.234091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.236431Z","title":"Science China Information Sciences , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.236431Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:c47a48a611634dc6b67c674faee5850bc283ccb9e79b913f2635a07427605a60","observation_id":"80f70ecc-109d-4d29-992a-4f3f815c1239","resolution":{"observed_at":"2026-08-04T17:23:16.236431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-07T17:13:10.057242Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00321","snapshot_observed_at":"2026-08-04T17:23:16.238872Z","title":"arXiv preprint arXiv:2501.00321 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.238872Z"},"links":{"cited_paper":"/paper/2501.00321","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:671cc33d1807a235e0d940c05b43319971107acc14a5177d8edad40659159641","observation_id":"e7b92d26-7f26-4394-a719-9e30eebff866","resolution":{"observed_at":"2026-08-04T17:23:16.238872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.241772Z","title":"Computer Vision -- ECCV 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.241772Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1a080581cb969d06507ffaf8fa422818ba5243253f0b057eed6c6c8f78f06464","observation_id":"b96a303f-5579-4ef9-8d47-82a7f6e9de61","resolution":{"observed_at":"2026-08-04T17:23:16.241772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17107","last_updated":"2024-02-02T19:44:14Z","snapshot_observed_at":"2026-07-06T15:48:29.049336Z","submitted_at":"2023-06-29T17:08:16Z","title":"LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17107","snapshot_observed_at":"2026-08-04T17:23:16.244130Z","title":"arXiv preprint arXiv:2306.17107 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.244130Z"},"links":{"cited_paper":"/paper/2306.17107","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:2e7664797370d82a9d3c70db9e7826107c95c2f179533d585c188796a5b683a2","observation_id":"af204b94-4cd4-4e3f-91de-fc9cdbedc8e3","resolution":{"observed_at":"2026-08-04T17:23:16.244130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.246873Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2023 , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.246873Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:25c597687b056f93998cac7655b65b2e5e280eef3bdf49e6a25431c39e46ff7c","observation_id":"0ec51c70-979c-4de8-8738-41e0dc52ca0a","resolution":{"observed_at":"2026-08-04T17:23:16.246873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.249278Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.249278Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:53649dd02f6095d4c774307b225b40b6b6836159fc70da15879fe0d50f7919ee","observation_id":"9d757787-0fac-4949-865e-d84af149f26f","resolution":{"observed_at":"2026-08-04T17:23:16.249278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.251674Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.251674Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:6483db172e361dcd8339d50e4eff75dfba2ec25010f08ec40ad79422012fcc43","observation_id":"1057ed13-8c63-4fe5-bc3e-5a8c6f9bc3f3","resolution":{"observed_at":"2026-08-04T17:23:16.251674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.254058Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.254058Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:008f95d5d2dfa7dbb52abd5d3cab54e6d08ba85e3d218871da3e1f4a623298d3","observation_id":"b6c0bb62-f2d4-4b3f-9b37-ce1c836ab4cb","resolution":{"observed_at":"2026-08-04T17:23:16.254058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-04T17:23:16.256270Z","title":"arXiv preprint arXiv:2511.21631 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.256270Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:d9f3384854375a4791bdae8e6b9d1151598345098ee60610e45c1e9e27b02dce","observation_id":"a0c06f8c-e487-4dc6-a8de-b898dad33249","resolution":{"observed_at":"2026-08-04T17:23:16.256270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-04T17:23:16.259245Z","title":"arXiv preprint arXiv:2508.18265 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.259245Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:3d19c09242baafc6d542f2bbdf7449f3d6ae822a8e607aab855c2d3df1317ee5","observation_id":"7b19cb67-6e49-4047-b027-beb260698c80","resolution":{"observed_at":"2026-08-04T17:23:16.259245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.262168Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.262168Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f239cbc0e9cf06fd7116ff2b6116d5a81ae7892e97676fea4e08485cbee78e00","observation_id":"2b9d2b5a-5ac7-45c6-a90f-6207f9b2b115","resolution":{"observed_at":"2026-08-04T17:23:16.262168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.264509Z","title":"Computer Vision -- ECCV 2024 , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.264509Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:b0a91c3f017ee75cf86758d4eda91f2d2dc84a11d57da2d480b52273128f5db0","observation_id":"4285a41b-b788-473e-afb3-6cb721ca6610","resolution":{"observed_at":"2026-08-04T17:23:16.264509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-04T17:23:16.266838Z","title":"arXiv preprint arXiv:2410.17247 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.266838Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:cd0a310f8fe762e105324605a904f8c8a2dd7cbee79b01a78897b62173606642","observation_id":"3ced6690-2b55-486a-885a-e14346f1154e","resolution":{"observed_at":"2026-08-04T17:23:16.266838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.269395Z","title":"and Okuno, Tomoyuki and Nakata, Yohei and Keutzer, Kurt and Zhang, Shanghang , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.269395Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1813ed1f2a3060525cb39741462e3f2326e3fe36dbb092c14a9a53e9f12db928","observation_id":"91162634-3a3d-4b23-b02a-9c759a58f3bf","resolution":{"observed_at":"2026-08-04T17:23:16.269395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.271539Z","title":"The Fourteenth International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.271539Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1a27ded79f0ff77d5d0fbcd7f58a30198d657dc767044d2d3db41a3aad9171fb","observation_id":"f7debecc-3b70-4cb7-a942-d6317034d828","resolution":{"observed_at":"2026-08-04T17:23:16.271539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.274701Z","title":"arXiv preprint arXiv:2509.24837 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.274701Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:fc326f4c79801c5eb736e45812bcf8ca3541da591f5d69e24cb402bfbc64ff55","observation_id":"e1349d50-b950-4aea-b4fa-c036eb7f4d40","resolution":{"observed_at":"2026-08-04T17:23:16.274701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.276987Z","title":"The Thirty-Ninth Annual Conference on Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.276987Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:b2735ed21876013d01033b2a4bebd025dd4ed56a16ebe4d4547e6c94feb0ee28","observation_id":"ed74f993-a7ac-4ecf-b0fa-3ade1ecc9fce","resolution":{"observed_at":"2026-08-04T17:23:16.276987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.279335Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.279335Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1a6a1c8347d709812a1d8f26e86a0a8a4e20a94104c05569861a3fbfb7a42286","observation_id":"a1e8daec-0ad8-42fc-91ed-42ffb196d330","resolution":{"observed_at":"2026-08-04T17:23:16.279335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.281537Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.281537Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:bca16514ba69a2c294fbd9b1e75dd3e3c5dc1e6607ea287db0c02179a9de0f99","observation_id":"63f807ed-abae-4d20-bf38-3bea1f3aeaef","resolution":{"observed_at":"2026-08-04T17:23:16.281537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10803","last_updated":"2024-11-16T13:45:33Z","snapshot_observed_at":"2026-08-08T00:44:00.494972Z","submitted_at":"2024-11-16T13:45:33Z","title":"Multi-Stage Vision Token Dropping: Towards Efficient Multimodal Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10803","snapshot_observed_at":"2026-08-04T17:23:16.283827Z","title":"arXiv preprint arXiv:2411.10803 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.283827Z"},"links":{"cited_paper":"/paper/2411.10803","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:d6f541d7d8d239e30d334cdcaa3aee0f3260a7f8e4fb88079ea746ba0bd82d6d","observation_id":"56ac6f38-9978-46a6-aff6-7293d6157dac","resolution":{"observed_at":"2026-08-04T17:23:16.283827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.286392Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.286392Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:9b80f853c775e595d70e1550429998e3f5de194a9f2fea50bebb94a86257a060","observation_id":"f0aad939-9553-427f-ba33-a8fd57dc7134","resolution":{"observed_at":"2026-08-04T17:23:16.286392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.288774Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.288774Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:1ade3efcafec53cc04a5cbc2dd4afebd00397b89cd1cba6e1a83383da52e091a","observation_id":"daba2d85-d58d-46fb-a2a7-a524b9a00b16","resolution":{"observed_at":"2026-08-04T17:23:16.288774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.290878Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.290878Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:b674f8c2bfa38b6362820046698f8b60cb4106db7027429715eca9510a68e775","observation_id":"d5e0c4ff-4087-41e2-a3a7-3d7d5f21d778","resolution":{"observed_at":"2026-08-04T17:23:16.290878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.293693Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.293693Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:e76df08ecbc6460d3b15c72e287f431bc8e7d27d0c9ec06a0ba09853b74b28fb","observation_id":"e9991464-cee1-44fd-af42-393f698b63f7","resolution":{"observed_at":"2026-08-04T17:23:16.293693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14228","last_updated":"2024-11-21T15:37:52Z","snapshot_observed_at":"2026-07-06T19:53:47.605701Z","submitted_at":"2024-11-21T15:37:52Z","title":"FocusLLaVA: A Coarse-to-Fine Approach for Efficient and Effective Visual Token Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14228","snapshot_observed_at":"2026-08-04T17:23:16.296228Z","title":"arXiv preprint arXiv:2411.14228 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.296228Z"},"links":{"cited_paper":"/paper/2411.14228","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:0ec9266a665ab70f78a732ced9e19123b60f5c930b0df513699e1c2228bbe7ea","observation_id":"924ecc97-c796-401d-83cf-d8baec19dfba","resolution":{"observed_at":"2026-08-04T17:23:16.296228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.298693Z","title":"The Fourteenth International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.298693Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:08b7b7929673c63f7ff05536ca64ca8b74e3d096c0f217680ac527fd36e2a72d","observation_id":"d8689bff-a83a-4786-8b6c-a56d3bf64478","resolution":{"observed_at":"2026-08-04T17:23:16.298693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.300943Z","title":"arXiv preprint arXiv:2507.20630 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.300943Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:929c872604b16b885e5e21461d77200394a0460eb083488af6130092517f4d8f","observation_id":"5bfb6a66-56d3-4d8a-a9be-46a4c9ea2904","resolution":{"observed_at":"2026-08-04T17:23:16.300943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.303329Z","title":"and Piergiovanni, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.303329Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:d512c953d1c2610608af28407e4245d28b0db9803210f6b4e3629a3fcbf8f47e","observation_id":"42e4f99b-8179-413f-96f8-ca3031ac7aab","resolution":{"observed_at":"2026-08-04T17:23:16.303329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.305635Z","title":"The Eleventh International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.305635Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:e824894820548b5f57b41dd4bc4da0c5cf970c8db04cce911ac206e44c298ea5","observation_id":"31b74e81-d549-48df-82dc-2bcc068b7f2f","resolution":{"observed_at":"2026-08-04T17:23:16.305635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.307728Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.307728Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:43538e8e1096212594d0535abf814a325ad98e663e86f8b130621071c918fa85","observation_id":"545396b8-e7c3-40e4-8bfa-7fdc8d6a834d","resolution":{"observed_at":"2026-08-04T17:23:16.307728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.08983","last_updated":"2017-02-21T16:21:21Z","snapshot_observed_at":"2026-08-04T14:24:45.814840Z","submitted_at":"2016-03-29T22:09:00Z","title":"Adaptive Computation Time for Recurrent Neural Networks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.08983","snapshot_observed_at":"2026-08-04T17:23:16.309788Z","title":"arXiv preprint arXiv:1603.08983 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.309788Z"},"links":{"cited_paper":"/paper/1603.08983","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:399d2195fd4aaf69d7e73b455d5a765cf82ca3fbfafbfb82189b4a951cdb09ae","observation_id":"60ac6df1-7e3a-44f3-9d55-e4376775bb35","resolution":{"observed_at":"2026-08-04T17:23:16.309788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.312500Z","title":"and Grauman, Kristen and Feris, Rogerio , title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.312500Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:5a9a5d1a055c5dfc667b903ff66f529ed85f167b409707dd57cea42159ed4d17","observation_id":"b719c8b9-dc49-4e0d-9ad7-f2b85b8abc67","resolution":{"observed_at":"2026-08-04T17:23:16.312500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.314794Z","title":", title =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.314794Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:5b42fa24f579265ee0f248ebd6251e0e56914b4600c3b4bc2437609df72c128a","observation_id":"a88c8932-9a4f-47ed-8f12-9fbe2c9227a8","resolution":{"observed_at":"2026-08-04T17:23:16.314794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.317042Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.317042Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:74b3f33d7c01c3644fd7fc32a8897668880bc33ba2f43bd26b6332d40abb548a","observation_id":"680e4685-233e-498f-9200-c744d39e8287","resolution":{"observed_at":"2026-08-04T17:23:16.317042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.319256Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.319256Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:de5b853b2330f9709be644c495ae136b49cb5f4f42f97a8f4bffd00446f80a02","observation_id":"3ec376e1-657d-4e7d-b78a-271032e5e60d","resolution":{"observed_at":"2026-08-04T17:23:16.319256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.321518Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.321518Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f09c3b183c0d768e7b26d67249ac99cc4383251aa73a0098b6a0376f7db3a183","observation_id":"116a78d3-95b8-4046-b8d6-70280056484c","resolution":{"observed_at":"2026-08-04T17:23:16.321518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.323717Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.323717Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f4ceaca28e5ced8ebe9603edfe4e94bad3cca2d05e03c88cf19237f14619a2a3","observation_id":"13f46ad9-817f-476f-9ff8-8c2ddc5b1170","resolution":{"observed_at":"2026-08-04T17:23:16.323717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.326153Z","title":"and Tay, Yi and Metzler, Donald , title =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.326153Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:34b1763d4fb1aa5bbe93a183b439fb817b709a8fa86a221975d7f050317040d0","observation_id":"754eb6c5-b16d-4d12-9e8d-e0bf403b5466","resolution":{"observed_at":"2026-08-04T17:23:16.326153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-07-06T17:54:47.689340Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-04T17:23:16.328575Z","title":"and Lillicrap, Timothy and Humphreys, Peter C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.328575Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:9f7fbaa83ffb43d70144e96da81adc5d02cc27a5a1a1ebbb78fd5a29c80254bc","observation_id":"f36d8354-964a-448f-a822-848958918f06","resolution":{"observed_at":"2026-08-04T17:23:16.328575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T17:23:16.331156Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.331156Z"},"links":{"citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f37cac0ce5ea249671fbe4fcf8be231731593a2e2f77ec96fbb2bf44e4336260","observation_id":"b2336bbc-b73c-4319-a773-c473372379d0","resolution":{"observed_at":"2026-08-04T17:23:16.331156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00899","last_updated":"2023-11-01T23:40:07Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T23:40:07Z","title":"RoboVQA: Multimodal Long-Horizon Reasoning for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00899","snapshot_observed_at":"2026-08-04T17:23:16.333572Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.333572Z"},"links":{"cited_paper":"/paper/2311.00899","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:f3e98e331cd45ab7f551f70bebc8b4495bb3591bdfaf34827a885c9d7044855e","observation_id":"a1e4b0bf-e2ca-4828-9e18-74412de29071","resolution":{"observed_at":"2026-08-04T17:23:16.333572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-04T17:23:16.335985Z","title":"arXiv preprint arXiv:2306.13394 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T17:23:16.335985Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2608.01979"},"observation_digest":"sha256:191d79941b9ec590e333871e2da93d5fdf4869be8ff17c6ce389e3a01bffa612","observation_id":"b4063264-a7af-40be-af5e-44770881646b","resolution":{"observed_at":"2026-08-04T17:23:16.335985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01979","last_updated":"2026-08-03T09:42:34Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T11:30:20.131465Z","submitted_at":"2026-08-03T09:42:34Z","title":"ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2608.01979."}