{"as_of":"2026-08-09T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9184390b9a322267647972fbfab853368c5625f93c7f10d8dd0318a2e48b453d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T11:11:17.788093Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.109589Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2410.10781","last_updated":"2025-03-02T14:37:53Z","snapshot_observed_at":"2026-08-02T20:46:05.666977Z","submitted_at":"2024-10-14T17:50:28Z","title":"When Attention Sink Emerges in Language Models: An Empirical View","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-16T17:41:03.674759Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2410.10781"},"observation_digest":"sha256:53a78030c6311531c2a4f91d97ac18514a9502bfea78326bfe864d9f3d5ff61b","observation_id":"97fa194d-5d25-4a7e-8d84-69069a3bbfd9","resolution":{"observed_at":"2026-05-16T17:41:03.758200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-09T11:11:17.788093Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02789","last_updated":"2025-05-19T18:24:50Z","snapshot_observed_at":"2026-08-09T11:04:51.007349Z","submitted_at":"2025-02-05T00:22:06Z","title":"Speculative Prefill: Turbocharging TTFT with Lightweight and Training-Free Token Importance Estimation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T11:11:17.788093Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2502.02789"},"observation_digest":"sha256:ddf1bab067da5a75008b368ce93b75b66597d70bbfc9a31d4e9a9301bb0b8a47","observation_id":"73bf3f2f-7191-4dfb-b041-4b4823b62010","resolution":{"observed_at":"2026-08-09T11:11:17.788093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T15:15:11.922497Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.15816","last_updated":"2025-05-21T17:59:52Z","snapshot_observed_at":"2026-08-09T17:21:51.898724Z","submitted_at":"2025-05-21T17:59:52Z","title":"Streamline Without Sacrifice -- Squeeze out Computation Redundancy in LMM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:11.922497Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2505.15816"},"observation_digest":"sha256:9e425c4cbdfbb687b4fd95c45ec4b7f8c54551e10c61961be6b81fa4590c4c11","observation_id":"e0eeda1f-9f52-4ae6-9519-2ecb36638b25","resolution":{"observed_at":"2026-08-07T15:15:11.922497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T14:16:18.606283Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference.arXiv preprint arXiv:2406.18139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-08T23:51:09.753030Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:18.606283Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:476047c55700e59563e28e790e6b8b1c31a9ecddcef054d017171bd3676a8e8c","observation_id":"1cabc8b2-404d-4115-8940-3fe58a98ed21","resolution":{"observed_at":"2026-08-07T14:16:18.606283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T13:14:05.941977Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference.arXiv preprint arXiv:2406.18139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22396","last_updated":"2025-05-28T14:24:02Z","snapshot_observed_at":"2026-08-09T06:04:09.043938Z","submitted_at":"2025-05-28T14:24:02Z","title":"Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:14:05.941977Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2505.22396"},"observation_digest":"sha256:5010ec60f99f5851532f2d542621cf4a2a485a34e844e5ad0fbe7e053245bf1d","observation_id":"eaf5978a-e6b8-4f6c-928f-420226815c55","resolution":{"observed_at":"2026-08-07T13:14:05.941977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T10:20:43.864806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15724","last_updated":"2025-06-06T01:51:24Z","snapshot_observed_at":"2026-08-07T10:11:30.411161Z","submitted_at":"2025-06-06T01:51:24Z","title":"MadaKV: Adaptive Modality-Perception KV Cache Eviction for Efficient Multimodal Long-Context Inference","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:20:43.864806Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2506.15724"},"observation_digest":"sha256:34922fcc78d5d49074b0b0599b7a1f5148094eb2e1e9fd096c2a93b568d34786","observation_id":"b3ee3db6-3c52-4b84-865b-109953407c42","resolution":{"observed_at":"2026-08-07T10:20:43.864806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-06T23:42:13.894002Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference.arXiv preprint arXiv:2406.18139, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16691","last_updated":"2025-06-20T02:25:33Z","snapshot_observed_at":"2026-08-09T05:13:31.220024Z","submitted_at":"2025-06-20T02:25:33Z","title":"LaVi: Efficient Large Vision-Language Models via Internal Feature Modulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:13.894002Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2506.16691"},"observation_digest":"sha256:21ed38f8d4ac073c303f768182cc16557ca454d5255ea1b6b6dc9ab6cdd4e3e7","observation_id":"fdea2b54-0b7f-49e1-965a-c3998b9c5e04","resolution":{"observed_at":"2026-08-06T23:42:13.894002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-06T23:00:11.193142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20187","last_updated":"2025-07-02T05:12:29Z","snapshot_observed_at":"2026-08-07T20:42:38.846597Z","submitted_at":"2025-06-25T07:26:42Z","title":"Breaking the Boundaries of Long-Context LLM Inference: Adaptive KV Management on a Single Commodity GPU","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T23:00:11.193142Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2506.20187"},"observation_digest":"sha256:697641307e5443d2da0f289ae5194db40dce1ec3b8161290de4cd09237b4cf26","observation_id":"b265b223-eb3a-43b3-b1eb-2b0e57b0a087","resolution":{"observed_at":"2026-08-06T23:00:11.193142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-06T18:32:49.280218Z","title":"Look-m: Look- once optimization in kv cache for efficient multimodal long- context inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07990","last_updated":"2025-07-10T17:59:02Z","snapshot_observed_at":"2026-08-09T00:35:41.482303Z","submitted_at":"2025-07-10T17:59:02Z","title":"Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:32:49.280218Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2507.07990"},"observation_digest":"sha256:c7c8689cb63798952e577ff7c2c19e058851f0d04516ea2d1f78e1f6db13a644","observation_id":"50d62950-433e-436a-9662-4ce9c855f577","resolution":{"observed_at":"2026-08-06T18:32:49.280218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2604.11627","last_updated":"2026-04-13T15:38:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T15:38:22Z","title":"POINTS-Long: Adaptive Dual-Mode Visual Reasoning in MLLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T15:23:08.671342Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2604.11627"},"observation_digest":"sha256:5860a2be7750b42de67737b637238890e8dac946cfdb1f20d184ebe688081dbe","observation_id":"288fe766-d424-4dab-bd1f-25d092fcba27","resolution":{"observed_at":"2026-05-11T10:41:03.814093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2604.16734","last_updated":"2026-04-17T22:45:57Z","snapshot_observed_at":"2026-08-02T05:19:18.112703Z","submitted_at":"2026-04-17T22:45:57Z","title":"Reducing Peak Memory Usage for Modern Multimodal Large Language Model Pipelines","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T08:16:02.102975Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2604.16734"},"observation_digest":"sha256:c1a02ff4ed7055cb745161e94c42480ffd3272e67e27164f4fbe5ebb4a11087b","observation_id":"21c60f4b-2a68-41c3-ab1a-f1f0fae2b42c","resolution":{"observed_at":"2026-05-10T08:17:37.412398Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2604.18260","last_updated":"2026-04-20T13:33:50Z","snapshot_observed_at":"2026-08-09T16:49:29.789134Z","submitted_at":"2026-04-20T13:33:50Z","title":"Geometry-Guided 3D Visual Token Pruning for Video-Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T05:49:38.346274Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2604.18260"},"observation_digest":"sha256:3f2e13a5d5cabd28529e15c37ffe03e797847432bb4366ada12786024c36918a","observation_id":"877a345f-8fb9-460f-86e1-7b63debec640","resolution":{"observed_at":"2026-05-10T05:51:09.954656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2604.25642","last_updated":"2026-04-28T13:42:27Z","snapshot_observed_at":"2026-07-06T23:11:30.068819Z","submitted_at":"2026-04-28T13:42:27Z","title":"Prefill-Time Intervention for Mitigating Hallucination in Large Vision-Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-07T16:50:26.044591Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2604.25642"},"observation_digest":"sha256:9a7234e2909892048c9fb3ca56b19c979f09990b38bd28a5b904fc58fb364abf","observation_id":"8fc9dade-a558-48f2-aa43-ee39443b6fcb","resolution":{"observed_at":"2026-05-11T23:31:16.285028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2605.04075","last_updated":"2026-04-14T08:17:53Z","snapshot_observed_at":"2026-08-03T03:08:39.084770Z","submitted_at":"2026-04-14T08:17:53Z","title":"RetentiveKV: State-Space Memory for Uncertainty-Aware Multimodal KV Cache Eviction","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-10T15:29:17.567557Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2605.04075"},"observation_digest":"sha256:4bf2d14e168f4980875d712c5757526e11fa6ad7b7b37b2a3e3f824ccc4db4d6","observation_id":"b76fe186-f0f4-48b4-8d16-e9c3f2ee60b0","resolution":{"observed_at":"2026-05-11T10:26:02.116725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2605.06611","last_updated":"2026-05-07T17:28:55Z","snapshot_observed_at":"2026-08-03T12:02:38.374401Z","submitted_at":"2026-05-07T17:28:55Z","title":"The Structural Origin of Attention Sink: Variance Discrepancy, Super Neurons, and Dimension Disparity","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T12:11:04.146711Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2605.06611"},"observation_digest":"sha256:a41344b27fe0c3f38fe882f1c6e85857ec8aa937215658e254ee5b62554f2c1e","observation_id":"83b6d075-edef-44c0-aa23-0f1e797cb643","resolution":{"observed_at":"2026-05-11T19:21:08.583429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2605.16439","last_updated":"2026-05-14T23:01:58Z","snapshot_observed_at":"2026-08-01T17:11:05.881460Z","submitted_at":"2026-05-14T23:01:58Z","title":"KVCapsule: Efficient Sequential KV Cache Compression for Vision-Language Models with Asymmetric Redundancy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T19:55:35.051834Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2605.16439"},"observation_digest":"sha256:1cbc35f34b700e844e71352045f945155fed01bcc13052093e131e5cda4da191","observation_id":"420c0c10-6f9d-40d2-b6af-f9b97f0c0fc8","resolution":{"observed_at":"2026-05-20T19:58:59.074345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2605.31457","last_updated":"2026-05-29T15:51:12Z","snapshot_observed_at":"2026-08-05T20:26:12.081479Z","submitted_at":"2026-05-29T15:51:12Z","title":"VisionPulse: Dynamic Visual Sparsity for Efficient Multimodal Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:13:15.593994Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2605.31457"},"observation_digest":"sha256:04c01f606c93a08462a223febbd0e7b116767c205202d108c1472ede9eb0a7c2","observation_id":"1c2908e8-a975-435b-a5e8-182033b85bd2","resolution":{"observed_at":"2026-06-29T00:12:50.575478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2606.08302","last_updated":"2026-06-06T18:58:26Z","snapshot_observed_at":"2026-08-06T09:32:24.096311Z","submitted_at":"2026-06-06T18:58:26Z","title":"HACK++: Towards More Effective Head-Aware Key-Value Compression for Efficient Visual Autoregressive Modeling","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T19:46:43.514413Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2606.08302"},"observation_digest":"sha256:b1d5ec1ba28d66704a2c2c3620eb7c2e6b2d14c5608233174b4f2b1593cebd6b","observation_id":"3c964e99-c6c0-42ff-9c93-a4a254a53dc9","resolution":{"observed_at":"2026-07-02T21:27:24.429651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2406.18139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-07-10T01:36:44.109589Z","title":"Look-m: Look-once optimization in kv cache for efficient multimodal long-context inference","venue":"cs.CL","work_id":"da97cf3b-beee-4636-a502-e1fe148927cb","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:19dfff8c93e3133110c65a4980df327ad95b6c328f5e27031b8ee661f027d4da","observation_id":"bd0d4249-644e-4203-951f-b49b07767c22","resolution":{"observed_at":"2026-07-10T01:36:44.110744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-02T11:58:29.746228Z","title":"LOOK-M : Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:29.746228Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:a3ec567518c82fdf1707a5216e2168d9776ef5e8eb125070952290ac4ddadefa","observation_id":"f4c52329-4ebd-4876-957d-ec47b3ddc319","resolution":{"observed_at":"2026-08-02T11:58:29.746228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-04T13:43:57.570458Z","title":"arXiv preprint arXiv:2406.18139 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-04T13:43:57.570458Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:a7de0e7937af724f87f82372e5a4e3e97123817e1ac50face0fad1abfb0870f8","observation_id":"88d04430-1dc0-4359-9dc8-82ebca331afd","resolution":{"observed_at":"2026-08-04T13:43:57.570458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18139","snapshot_observed_at":"2026-08-07T00:11:49.173076Z","title":"arXiv preprint arXiv:2406.18139 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02150","last_updated":"2026-08-05T06:57:37Z","snapshot_observed_at":"2026-08-09T07:46:30.048448Z","submitted_at":"2026-08-03T12:34:31Z","title":"PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-07T00:11:49.173076Z"},"links":{"cited_paper":"/paper/2406.18139","citing_paper":"/paper/2608.02150"},"observation_digest":"sha256:1760f0bb8b95fef6519c68c6e10a00a234d9e7cf835b3497c298a2e95ab5431f","observation_id":"dda273cf-5b28-49da-b79b-5437f6da7fce","resolution":{"observed_at":"2026-08-07T00:11:49.173076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.18139/citation-record","integrity":"/paper/2406.18139/integrity","json":"/paper/2406.18139/citation-record.json","paper":"/paper/2406.18139"},"outbound":[],"paper":{"arxiv_id":"2406.18139","last_updated":"2024-06-26T07:44:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T06:27:25.663339Z","submitted_at":"2024-06-26T07:44:24Z","title":"LOOK-M: Look-Once Optimization in KV Cache for Efficient Multimodal Long-Context Inference"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2406.18139."}