{"as_of":"2026-08-13T05:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49b3a442cd09142355e88c7d5a0813d3d8c6e582cf8bd9a21b89b3e291223ac3","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:06:51.651724Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20357/citation-record","integrity":"/paper/2607.20357/integrity","json":"/paper/2607.20357/citation-record.json","paper":"/paper/2607.20357"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-01T10:06:47.695617Z","title":"arXiv preprint arXiv:2308.12966 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:47.695617Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:b086fc4c87482dc8eb2f58e3b3f29fef9d87574165019e0654f38cde010762b0","observation_id":"33083030-7ce3-45a7-bea2-861adf373d98","resolution":{"observed_at":"2026-08-01T10:06:47.695617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T10:06:47.778122Z","title":"arXiv preprint arXiv:2511.21631 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:47.778122Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:8c5596b3e3b9db2e9642aa6b0a21a8346da4c2bd1287fb8352add1a075e1f4cc","observation_id":"832be324-7c75-4a7b-9486-f45a719378e0","resolution":{"observed_at":"2026-08-01T10:06:47.778122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-12T17:29:41.806995Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-01T10:06:47.849062Z","title":"arXiv preprint arXiv:2502.13923 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:47.849062Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:fc7d0845bff0732fb179cd08c8724913d06bbf60c769cbf86daf29420e62d4bb","observation_id":"3d20343a-b080-4528-914a-6d1e098aac01","resolution":{"observed_at":"2026-08-01T10:06:47.849062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:47.922286Z","title":"In: ECCV (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:47.922286Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:986b8253adcc746a64e3853713969a759211c6e1f792c7d18107486a6cee8ceb","observation_id":"da35e4ab-345a-4fd2-ad05-54be2ad208af","resolution":{"observed_at":"2026-08-01T10:06:47.922286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-01T10:06:48.034588Z","title":"arXiv preprint arXiv:2312.16886 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.034588Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:ec86e571ff4a3600139f197de91285160164af4e370800171e941b5da49f6baf","observation_id":"9675f9e0-1450-4c98-8d71-2426b9e48ead","resolution":{"observed_at":"2026-08-01T10:06:48.034588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03766","last_updated":"2024-02-06T07:16:36Z","snapshot_observed_at":"2026-08-09T19:28:34.281681Z","submitted_at":"2024-02-06T07:16:36Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03766","snapshot_observed_at":"2026-08-01T10:06:48.180556Z","title":"arXiv preprint arXiv:2402.03766 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.180556Z"},"links":{"cited_paper":"/paper/2402.03766","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:38167464908d9b654f73b7f29f2a4ec7ac6ab5e981920a2b228ea31af7bee5f9","observation_id":"334e0b21-23cc-4d92-a6f9-0c5ebd2ea163","resolution":{"observed_at":"2026-08-01T10:06:48.180556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.291791Z","title":"In: NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.291791Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:d7d60edbb5e8d2fd319f7a786d5430600411fea883fae8f87cfb30e505d5086f","observation_id":"9223c2c4-6d8c-4cfe-9066-2e3ef76518b3","resolution":{"observed_at":"2026-08-01T10:06:48.291791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.366741Z","title":"In: CVPR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.366741Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:ef13af3f774b5f125f5eb5c2d3ec602872e63b50b1d82ddc682ae654dff625bd","observation_id":"016dff88-aaa2-4268-b22d-8e6d6579dad1","resolution":{"observed_at":"2026-08-01T10:06:48.366741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.476063Z","title":"In: NeurIPS (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.476063Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:11056987f7d982f51f4273cf1dbf385861b865ff1ea9228d05df84aa8ca2bab7","observation_id":"8997f2ef-bb83-4edd-b3f9-d3993d6bea7c","resolution":{"observed_at":"2026-08-01T10:06:48.476063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.551399Z","title":"In: CVPR (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.551399Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:ba6e98486f462ddb70c77a9daeed3f5a2e040266f200d332c4b55a73092d072d","observation_id":"aea52b81-3a11-48c0-8400-30d9e35ec467","resolution":{"observed_at":"2026-08-01T10:06:48.551399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.631294Z","title":"In: CVPR (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.631294Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:28229cde15a9d3b58865c0acbc0f002066ffe6aeef72279f0cc8c49897e6ebb9","observation_id":"df22da5c-d882-49b1-bdcc-75c308ddb533","resolution":{"observed_at":"2026-08-01T10:06:48.631294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.734030Z","title":"In: ECCV (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.734030Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:f2fd6a85c6841c6b53176578b7bf3287eb122fc5fd67e75dc70784042c3469ca","observation_id":"13efcf81-167a-4fae-a72d-bb8193229740","resolution":{"observed_at":"2026-08-01T10:06:48.734030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.839382Z","title":"In: CVPR (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.839382Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:90397bb1bcdc7f1c10144f67949510c9c934ae7b5e3c4b6dd74540035ac07b2b","observation_id":"85eec7d9-7cec-4a68-ac12-739e8ffb33c5","resolution":{"observed_at":"2026-08-01T10:06:48.839382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.920372Z","title":"In: CVPR (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.920372Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:c2361228cf7272a2d635f3f63376b9f811d44069cbb59c019367d7a85a91e35d","observation_id":"22fc621c-2ac2-4608-8e42-fac6a5f01258","resolution":{"observed_at":"2026-08-01T10:06:48.920372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:48.980886Z","title":"In: ICLR (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:48.980886Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:3969b9a37cc7bde0be16a950b3323aeaf8cc4a87e73604f7f8479daa0c7d2910","observation_id":"b623428c-130c-4cd2-b114-dac969958901","resolution":{"observed_at":"2026-08-01T10:06:48.980886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.066046Z","title":"Microsoft Research Blog (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.066046Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:6b1822398190590bfc3b0af61c26877794e90f793ae93460bd0dcfce61bd9ca1","observation_id":"52823952-3249-4e2e-b278-2f01f3f2dbc6","resolution":{"observed_at":"2026-08-01T10:06:49.066046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.128286Z","title":"In: ICML (2021) Look Less, Think Faster 17","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.128286Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:86ed66aeb23c7161cd28c76f191a26083e3cd47b34a2634a9abefe297f288fcc","observation_id":"f1012cf7-e804-4687-bdf5-62f8e87382c7","resolution":{"observed_at":"2026-08-01T10:06:49.128286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.209658Z","title":"In: ICML (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.209658Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:67d2aef8bde37d9c7a4cf5452a26888dfa0894eebb80b3f9e1182fa743f42451","observation_id":"148dc692-8f7f-4b1a-8958-45d3937d5359","resolution":{"observed_at":"2026-08-01T10:06:49.209658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.276745Z","title":"In: EMNLP (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.276745Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:54a50ee4bddc609e28eaccaa77818384395da1e6049f7435ec77e777b1fbc5a8","observation_id":"7d0095c1-0cde-4563-955e-27e9c7d0d6d3","resolution":{"observed_at":"2026-08-01T10:06:49.276745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.318972Z","title":"IEEE Transactions on Multimedia (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.318972Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:a40dfbc9e86b2a5a44eafb2a3cbd6790ee6d2a95a150ca0812f6a21be40f663e","observation_id":"79abb13b-b7b1-4d57-be90-8e7df14f16d6","resolution":{"observed_at":"2026-08-01T10:06:49.318972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.403530Z","title":"In: AAAI (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.403530Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:41812cda73a54e4027814ecbbf76cc1433da22f921daaae6d072aa2a6e43dcc5","observation_id":"27dc5474-9768-4a0b-8c53-732e24a40947","resolution":{"observed_at":"2026-08-01T10:06:49.403530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.490332Z","title":"In: CVPR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.490332Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:530a8c7163d01b49ebbf11fa09c9fbf443b236705f9febd76da077acd4ce0efa","observation_id":"c57325c4-7594-43d8-8015-6e7e52baa93c","resolution":{"observed_at":"2026-08-01T10:06:49.490332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.578287Z","title":"In: NeurIPS (2023), LLaVA: Large Language and Vision Assistant","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.578287Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:5da1e978dbf162bf4f76b7b49340a1b4069acd0875f2bbae0a1aded543d36693","observation_id":"d6c40ff0-0caa-4ce8-8530-6a811384c93a","resolution":{"observed_at":"2026-08-01T10:06:49.578287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.681989Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.681989Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:e8e32df58962de667ffa8abbec4fe66a6270655ff3cd7c847aaff2b8851ba29f","observation_id":"6afa8346-0d50-45fd-ad13-685988fe12b1","resolution":{"observed_at":"2026-08-01T10:06:49.681989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.769865Z","title":"In: NeurIPS (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.769865Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:beecd81046016dd79f667f41b81e351b7bf23c14a8a2085f9df626ce0b2fe8b3","observation_id":"3300dcfa-9d10-44ee-bbc8-b2f3560c44c7","resolution":{"observed_at":"2026-08-01T10:06:49.769865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.854243Z","title":"In: ICLR (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.854243Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:db5322986ad55a5ded300f0c9e95700a557fac8e79ced8a99b7a7294174b3ba6","observation_id":"097ae6ce-c630-4d23-a6c3-7a9b48b48150","resolution":{"observed_at":"2026-08-01T10:06:49.854243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:49.944287Z","title":"In: ICML (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:49.944287Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:c2a6c584f5b77e880f15aa0d5ffeb047d59afed49048a03c886ed62806e1a5bf","observation_id":"b26e5df7-2a23-4782-83b7-e4471b524e57","resolution":{"observed_at":"2026-08-01T10:06:49.944287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.006867Z","title":"In: ICCV (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.006867Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:3d5532e90b02a4e6f96419a7e0340cccdb3e5158629c58c0d4985041437a4d9e","observation_id":"22d6983c-236d-4221-92b9-96764a459039","resolution":{"observed_at":"2026-08-01T10:06:50.006867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.089906Z","title":"In: ICLR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.089906Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:ef240a74b7ceec46885a3b11517222c46fd25d94efda5c8d7b86c24d1ad2a3d5","observation_id":"cee5e865-2f3c-4cc4-97bf-e6640cd7a8d0","resolution":{"observed_at":"2026-08-01T10:06:50.089906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.175476Z","title":"In: CVPR (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.175476Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:ab7bd6860e02b831645763557248142fa2cfb610de66d24d4eceab9c46108b5e","observation_id":"d1024800-22cc-4f9b-84a8-b47df65d7b40","resolution":{"observed_at":"2026-08-01T10:06:50.175476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.289671Z","title":"Neurocomputing (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.289671Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:d584f9c16bcae474408633026c4464556d50e23cd173f28a0e8b28f0d5ad2299","observation_id":"bc5749c5-eabf-47a9-a80d-a84f65af7c44","resolution":{"observed_at":"2026-08-01T10:06:50.289671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.349239Z","title":"In: Conference on Robot Learning (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.349239Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:75059fc827307c32282e3c6ccd09f0b041b3f7834272f17285e7297fa80b9ba5","observation_id":"29dc3b28-efb4-4a74-bf3f-dc0e2e1ecf51","resolution":{"observed_at":"2026-08-01T10:06:50.349239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.433733Z","title":"In: CVPR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.433733Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:35ce2fe40bd421dd6d3662f7f4226bd42d96b136d7a2f208da48ab868cb3ce35","observation_id":"5c17521d-4d1d-4f2f-b8b6-2b5e48f647ee","resolution":{"observed_at":"2026-08-01T10:06:50.433733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.521899Z","title":"In: NeurIPS (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.521899Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:c88cd9341532290ca7bbfb29e8e026ddaeb84ac26876bfd614497c0d4faedf1f","observation_id":"05517c18-78e2-436f-b368-8b9867b3b19b","resolution":{"observed_at":"2026-08-01T10:06:50.521899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.580421Z","title":"In: NeurIPS (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.580421Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:1f3e87bd163d052fd37fc14592a1839023b046a95abc50c540a59ae6a8a7cef0","observation_id":"bf292cf7-fb72-489f-8dd5-8e796aa1e062","resolution":{"observed_at":"2026-08-01T10:06:50.580421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-01T10:06:50.666668Z","title":"arXiv preprint arXiv:2409.12191 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.666668Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:6e997359f09c27fdbe7eb6167c3f0c51b51b88ca6b3648f985b9e0d804891b72","observation_id":"8040fd3b-3a21-4e9d-96b3-bff1aba930ef","resolution":{"observed_at":"2026-08-01T10:06:50.666668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.752285Z","title":"In: ICCV (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.752285Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:34b74b37e172add571695a9e7d07af0e764984535c7b05cc851749075484e1af","observation_id":"06d62075-6dbd-409c-afcd-557adf7217f5","resolution":{"observed_at":"2026-08-01T10:06:50.752285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16862","last_updated":"2024-06-21T07:08:59Z","snapshot_observed_at":"2026-08-13T04:53:04.807772Z","submitted_at":"2023-12-28T07:11:41Z","title":"TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16862","snapshot_observed_at":"2026-08-01T10:06:50.835461Z","title":"arXiv preprint arXiv:2312.16862 (2023) 18 P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.835461Z"},"links":{"cited_paper":"/paper/2312.16862","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:62e24a1e7528a1d34203d9e08d3b56de97926a70701a783212dd029fedb2bc71","observation_id":"626bdd31-d71c-440a-8817-6af15d1a960d","resolution":{"observed_at":"2026-08-01T10:06:50.835461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:50.918635Z","title":"In: EMNLP Demo Track (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:50.918635Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:9dd1461c299c6a68879ac4b3e94b863cfbe7f5c6c81e91d0318adb2b5c048fa0","observation_id":"f8eb9860-1252-4e1a-b799-46619068aeb9","resolution":{"observed_at":"2026-08-01T10:06:50.918635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:51.029226Z","title":"IEEE TPAMI (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.029226Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:c7706dfb90b0d52294386155c089d923387c025131e3be66a1cc553b8b8c2ef1","observation_id":"a8a15a51-b4f5-484b-8aab-e940b64a6b31","resolution":{"observed_at":"2026-08-01T10:06:51.029226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:51.108630Z","title":"In: Findings of the Association for Computational Linguistics: NAACL 2025 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.108630Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:b8dcdfece4cb2d574880d1b19510dae587d87fd3b7fb547b245546fdb49a7e6c","observation_id":"a1f6ed91-537c-43df-931c-c6e0efb3b08b","resolution":{"observed_at":"2026-08-01T10:06:51.108630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:51.222132Z","title":"In: ICCV (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.222132Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:dc7aa279d88fd6cd0b8d593f66e6e9c6cf8dd9e3d784524e2508236fc5181c13","observation_id":"905fc19b-36af-415e-a878-3d3c9652242e","resolution":{"observed_at":"2026-08-01T10:06:51.222132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14289","last_updated":"2024-02-22T05:05:30Z","snapshot_observed_at":"2026-08-13T04:13:12.046147Z","submitted_at":"2024-02-22T05:05:30Z","title":"TinyLLaVA: A Framework of Small-scale Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14289","snapshot_observed_at":"2026-08-01T10:06:51.311375Z","title":"arXiv preprint arXiv:2402.14289 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.311375Z"},"links":{"cited_paper":"/paper/2402.14289","citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:c4cbcf4113180a3ab29d1d02044874a82ce976fa84c3d039f8ae0c11fe10dd4b","observation_id":"7ae5d872-688d-478a-9ef0-8bdd2bfe1341","resolution":{"observed_at":"2026-08-01T10:06:51.311375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:51.468682Z","title":"In: ICLR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.468682Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:303830f191425b897d4de36d0851ea9bf380dcaca064adb8db4b31afe7a35a73","observation_id":"730f6342-799a-4dd9-8df2-6063f89f35e7","resolution":{"observed_at":"2026-08-01T10:06:51.468682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:06:51.651724Z","title":"In: EMCLR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T10:06:51.651724Z"},"links":{"citing_paper":"/paper/2607.20357"},"observation_digest":"sha256:fc29caafef6d83ae8662b609c7a7f0893a9357bb4ba84ca1147ac40d4381f196","observation_id":"cfbc7a66-aa9b-4b9f-a521-5a8c406eaf7a","resolution":{"observed_at":"2026-08-01T10:06:51.651724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20357","last_updated":"2026-07-22T16:43:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T23:57:21.287384Z","submitted_at":"2026-07-22T16:43:27Z","title":"Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2607.20357."}