{"as_of":"2026-08-17T00:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b2f16859db3acc34e6358d6ddaf53e1782a54bcf8b8e8fe9269be78f014c9f0","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:02:06.917838Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:46:59.423533Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:51:42.929093Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.03762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","venue":null,"work_id":"1e8eb8c2-9491-42eb-b824-cc4861d96798","year":2025},"citing_paper":{"arxiv_id":"2605.07234","last_updated":"2026-05-08T04:37:22Z","snapshot_observed_at":"2026-08-11T16:13:04.469297Z","submitted_at":"2026-05-08T04:37:22Z","title":"Reformulating KV Cache Eviction Problem for Long-Context LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T02:37:52.545943Z"},"links":{"cited_paper":"/paper/2506.03762","citing_paper":"/paper/2605.07234"},"observation_digest":"sha256:f52c06d9705b794d42ab4863f64d30afbecd9a266d3ba3395b6cdf92626eaa4c","observation_id":"695d9391-85af-487c-bb26-f00175624c53","resolution":{"observed_at":"2026-05-11T03:10:53.504555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.03762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","venue":null,"work_id":"1e8eb8c2-9491-42eb-b824-cc4861d96798","year":2025},"citing_paper":{"arxiv_id":"2605.08234","last_updated":"2026-05-07T00:36:59Z","snapshot_observed_at":"2026-08-11T18:33:43.862136Z","submitted_at":"2026-05-07T00:36:59Z","title":"When Does Value-Aware KV Eviction Help? A Fixed-Contract Diagnostic for Non-Monotone Cache Compression","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:46:59.423533Z"},"links":{"cited_paper":"/paper/2506.03762","citing_paper":"/paper/2605.08234"},"observation_digest":"sha256:e90503c385f90a887d8a362e0a9e5af73465f04f6aecf5d6639cfe8513b9ad24","observation_id":"686cfe32-69bb-4571-80c5-46fe8e039912","resolution":{"observed_at":"2026-05-12T07:51:42.940121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03762/citation-record","integrity":"/paper/2506.03762/integrity","json":"/paper/2506.03762/citation-record.json","paper":"/paper/2506.03762"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-16T19:40:28.523700Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:02:04.003799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.003799Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:b67064af958614233a9e6f3dd9534c2a2e3fb6a78929ef05b02c735aeb2419c2","observation_id":"69dd8e94-b4a0-4211-b58e-49f760feff90","resolution":{"observed_at":"2026-08-07T11:02:04.003799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.434817Z","title":null,"venue":null,"work_id":"b81adc1e-a3bb-407a-8995-de07380a273a","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.078300Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:a50fb62e9b8a2a31d523c6a6bf63290d662f2c2352995d981d9651130b6a2417","observation_id":"d8559f0b-88f4-4183-aa06-31c74ca1227d","resolution":{"observed_at":"2026-08-07T11:02:11.464740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.364646Z","title":null,"venue":null,"work_id":"821dfdfe-f443-43b9-b477-758da0c8a4b9","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.119242Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e6aaef7ee18acfa6bc393c7a71ee308fd0a075f139d5782ec4a728af212ddfc3","observation_id":"aabd83b3-cc7b-4e50-9f55-f8802def6024","resolution":{"observed_at":"2026-08-07T11:02:11.390738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T11:02:04.187212Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.187212Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:5af45d79095732b8821ed192d91b4243b8fe984100b3d47c89b1ce4854234ed5","observation_id":"1eeb90a9-8fdb-4f11-87d6-34825ff3ebf0","resolution":{"observed_at":"2026-08-07T11:02:04.187212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.258969Z","title":null,"venue":null,"work_id":"77fb3123-c21a-4b1b-a1de-56c349062eeb","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.290634Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:f5f09df9ad43216a5160752e6ba05c72e658eb1b62663c3747c7c60a39ea33b5","observation_id":"d83a85ce-42d4-40c1-822c-8ed43563f29f","resolution":{"observed_at":"2026-08-07T11:02:11.313927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:11.063781Z","title":null,"venue":null,"work_id":"ab3eb925-be23-468c-9d6c-8172de4df245","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.344653Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:7f027402600391eba2d85cc844b11b640530f26b72f53e9d7f3ca0a76dcba7ba","observation_id":"75173bb3-11c8-4430-9adb-a5f15cb29760","resolution":{"observed_at":"2026-08-07T11:02:11.153489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.873696Z","title":null,"venue":null,"work_id":"f15edf64-ccad-4a93-98a8-271de064fbb0","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.404947Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e6bdad8c784816a188c93327d2e6eec540477f5911e1e58505867041e9e0a708","observation_id":"e347d273-acc3-452f-8b09-474b9172bf9a","resolution":{"observed_at":"2026-08-07T11:02:10.962742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T11:02:04.492749Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.492749Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:a2cde153342a6358136bb29f79ac5278678d15a697fabcf672c18969bad55338","observation_id":"3bfc0555-8c84-4e89-90c8-dd838e462077","resolution":{"observed_at":"2026-08-07T11:02:04.492749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:04.585736Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.585736Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:882b04b998107913e5df142b58744affd0864ce21ae76abefcb489c7bdf52131","observation_id":"30a325a0-3b98-48b9-ae38-9429ab53e66f","resolution":{"observed_at":"2026-08-07T11:02:04.585736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.673541Z","title":null,"venue":null,"work_id":"1203dc71-709f-491c-9e52-111f78c37456","year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.661844Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:15179b763f3cdd0c9d86b91d61a4ecd7d7b5cdbaab409e0116d6e5fa6b3760d4","observation_id":"45e95a16-f62c-443a-b878-f57d3227c1fe","resolution":{"observed_at":"2026-08-07T11:02:10.739655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.382686Z","title":null,"venue":null,"work_id":"6d0d5bf0-f401-4110-b12a-9b3f098c6a5f","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.696496Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:ffd33dd9fe3e31de0b3a9a39bf68cbb293a979f8f8f70aba39d8a39f9f8aebd8","observation_id":"ca4ff56c-4d27-45b7-9b94-4a023b1abd88","resolution":{"observed_at":"2026-08-07T11:02:10.532130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.225253Z","title":null,"venue":null,"work_id":"3506180b-9ea2-4de8-bdc8-ea6de4cd6772","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.782255Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:935e43f1ecfe4a4d5ee0785548df8aa03c53a83c9ca5e48189dcc66bc540a04e","observation_id":"6502974d-bbd1-4133-a642-7fab82bf8761","resolution":{"observed_at":"2026-08-07T11:02:10.280933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:10.028073Z","title":null,"venue":null,"work_id":"c7cd8267-f63d-49f0-9249-b015a9019a2a","year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.856867Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:11ecb2b2fa16931e6c6ee64e98ac9a1990182332843abc7a6e9dbeea01d8cb1a","observation_id":"c1821fb4-92d2-48d9-9751-cdaba51e04b1","resolution":{"observed_at":"2026-08-07T11:02:10.135312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.876367Z","title":null,"venue":null,"work_id":"bbf755bc-364f-4cfe-a8ef-eed98d5c60f9","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:04.932733Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:798339c7839a4b2f2c7ae16dc78c2a50b96a5453514e8ee7a01c324f414db6c7","observation_id":"647faa00-2921-46eb-93b7-bfc513b49462","resolution":{"observed_at":"2026-08-07T11:02:09.937719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.792677Z","title":null,"venue":null,"work_id":"f2a5d8e6-f379-410b-82e0-7f15b87fe5ff","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.014068Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:36a3316fc7846aea992df52c85d1bc9b4530ad092aca3caf5d87ba2d1f1b3f82","observation_id":"dcbd14cb-276b-414b-b22b-170f1f54940a","resolution":{"observed_at":"2026-08-07T11:02:09.861146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.677731Z","title":null,"venue":null,"work_id":"01dcca40-a23f-4bb6-9116-58eafc1416a7","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.066980Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:3b632102845104c49da161ddfc23ad7461a8a8bb498d4b224892075c27e5c769","observation_id":"d053e91e-710e-41bd-b870-1d1f76e48ccd","resolution":{"observed_at":"2026-08-07T11:02:09.737866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.595564Z","title":null,"venue":null,"work_id":"93d24def-0d1e-4c31-8b17-69d2e5134c38","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.127093Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:04500972831d4634c39c9c402255c9eb94a1f6c65a752e5ec41b0c20707d8fdf","observation_id":"9b743bcb-7f80-4ede-9bea-5abdae2d9e1f","resolution":{"observed_at":"2026-08-07T11:02:09.621684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.492613Z","title":null,"venue":null,"work_id":"0660550c-a820-42f4-9b71-ddd3b58ee71f","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.186003Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:660a2acd218e3a2af7c445b7fc0c66ffa787096e18066958e0bc635454bf923c","observation_id":"a9a0313b-6712-4a20-9702-db0ec8c326eb","resolution":{"observed_at":"2026-08-07T11:02:09.538400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.394729Z","title":null,"venue":null,"work_id":"dfa85dc4-3280-4e5c-b9d7-813726b7c04e","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.252028Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:31878a6ff09150c085ca3c925a993cad73592f7f8797058c7bd0e1b9596cc292","observation_id":"bfa4c65c-cddd-4c25-b30c-97e4fd02fcd7","resolution":{"observed_at":"2026-08-07T11:02:09.416255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.252751Z","title":null,"venue":null,"work_id":"469744ae-1fd9-4e67-9b26-c9f8cabd2147","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.321429Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:06e422bb8f166e74827e3f59c346015644e212d15281b6f8384fb53c3e706e2c","observation_id":"5598f046-e2d8-41ee-b20d-47ffd407645f","resolution":{"observed_at":"2026-08-07T11:02:09.297286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.138300Z","title":null,"venue":null,"work_id":"ce744704-8064-47a4-9a71-2db860e98262","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.371954Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:da8ccf8c119ffb039f4d475f34d48f08676555a4c65293a84cb8da20a026daec","observation_id":"9a72b31f-abb7-4d65-8b6a-4ad67e9ce1e8","resolution":{"observed_at":"2026-08-07T11:02:09.180353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-14T09:16:47.522119Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-08-07T11:02:05.405043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.405043Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:b09d0a15af83694c19d92dee835f806962312b830a9fff9e0334ff1667769d38","observation_id":"29bf034c-e1ac-4b9e-9c32-faac74261ea5","resolution":{"observed_at":"2026-08-07T11:02:05.405043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:09.043913Z","title":null,"venue":null,"work_id":"7f5adaec-5d87-4086-b15c-e62154e45898","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.434756Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:0c626fb2c24c73e3df41d6612f7efad882dafab5639c1dfbf7358193dd693e0f","observation_id":"6520c81b-c9da-4760-9f14-80f303bacd70","resolution":{"observed_at":"2026-08-07T11:02:09.103813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.922913Z","title":null,"venue":null,"work_id":"8149cce4-89dd-40cf-9dbc-18f28459d775","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.513189Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e539d7077ca90d8237c37d7974957b4bfb53d9d55bb0cf8b65bc8dd4c03a7f0a","observation_id":"7dae47b3-0bd9-4acf-8601-1f08fed57a05","resolution":{"observed_at":"2026-08-07T11:02:08.972313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.847027Z","title":null,"venue":null,"work_id":"865969ea-21d0-4898-a42d-6cc1cc30f9ca","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.580709Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:88a080b0f7055730e04b2dc8b05afb549818e81aa0d41f78fe0b9d7f2922f43d","observation_id":"83ab0304-5ead-4d1d-b007-c5602ad0e0f8","resolution":{"observed_at":"2026-08-07T11:02:08.881021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:05.627654Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.627654Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:177470ea340a769776a84af58a7de32fa9cfcb4376b53fdd776a58dc64a1009c","observation_id":"f5890b33-39d8-4e31-ac62-0e81b2ceced8","resolution":{"observed_at":"2026-08-07T11:02:05.627654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.716457Z","title":null,"venue":null,"work_id":"437bdb19-c23e-4b2f-bd6f-e29642ec92fb","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.692323Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:39819df734e03d0d83a3e0cddcee46803d7726b8e135a2079bec0c42aae4228a","observation_id":"553e2b68-acd7-44db-8d7d-1e93507fffe5","resolution":{"observed_at":"2026-08-07T11:02:08.761317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.643636Z","title":null,"venue":null,"work_id":"7a3d9ddd-18fe-4fac-b282-b6b6bdd4ad22","year":2018},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.736184Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:7f1d2d812ac31dff84a5fbb4d861c40fe54c57aab4602dbe2bb45d54d8c9c2cf","observation_id":"bd752377-9f6c-4ccc-a8b8-fcd8d0ddd16f","resolution":{"observed_at":"2026-08-07T11:02:08.678823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-16T14:28:08.030037Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T11:02:05.812475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.812475Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:4ee6cdcb1695e745352abe4dc4d922ef7336b54c34eb70a4276db38cc04f52bf","observation_id":"c0e8cf90-f4e9-4d22-b575-2d56dd548708","resolution":{"observed_at":"2026-08-07T11:02:05.812475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.525657Z","title":null,"venue":null,"work_id":"c114c3fb-6810-44d3-9b93-ea8d1065d04e","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.888815Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:dc660eabf8f61d5079a3dc8f8d435e92ac596eb9d3c12d0a595acf1ea69798ef","observation_id":"fa281451-1500-4aee-ae33-4f3ffc48bd67","resolution":{"observed_at":"2026-08-07T11:02:08.599149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.395466Z","title":null,"venue":null,"work_id":"6f1ef78d-30d7-4d8e-9a5a-4223450f5638","year":2019},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.944561Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:c7ce41897082e0708fedbaf84cc0c02be131a57c7f2cc8325dcd3d9e414a3f43","observation_id":"ed973358-054a-466a-8311-5d3d6b1cf73e","resolution":{"observed_at":"2026-08-07T11:02:08.471813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.261596Z","title":null,"venue":null,"work_id":"eefc3772-b5ec-47d9-97ef-1ba437a789a1","year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:05.965517Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:2f4c65e11eb468e3ba5d2861a6fdf20075d58943f632bd343593faedbec0b4e9","observation_id":"4f10922c-c04a-4c5a-a166-354b5f22962d","resolution":{"observed_at":"2026-08-07T11:02:08.325825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.186626Z","title":null,"venue":null,"work_id":"eb404934-8e06-4319-87db-3eb7ce3faac6","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.027228Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:916393be55d232205b95f7a764fd2e5e1c8cd7b9bcab8afbfb63be956eb4d6ae","observation_id":"c0c83452-0e22-4701-aad2-3330d6e10f76","resolution":{"observed_at":"2026-08-07T11:02:08.209876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.102270Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.102270Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:440c1ebaba416d4427b18f41151d3896b88d62c7958ffbf2bfed47177892eb6c","observation_id":"374f3778-149e-4d28-a4f8-ba99f657bc62","resolution":{"observed_at":"2026-08-07T11:02:06.102270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:08.050067Z","title":null,"venue":null,"work_id":"4446530c-9e46-40a0-a341-492eebd1e024","year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.143858Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:40a195b175be8b59ff0cb8c28a51b7d788767e1d7e8a8de5311bf675900b9d06","observation_id":"5590e404-6aa1-4b4e-aded-816a2f228aa6","resolution":{"observed_at":"2026-08-07T11:02:08.103917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.908392Z","title":null,"venue":null,"work_id":"09a67fa4-d9de-4b17-b342-2f69d4f24331","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.218074Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:0bd97042e0b6b8fca5baa504beecceac0ca029d75a9d44a017fe16692c9c1ba4","observation_id":"4827288d-3213-4595-80f2-56837cc95424","resolution":{"observed_at":"2026-08-07T11:02:08.010386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:02:06.253737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.253737Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:28af86d7f82b76f0b4a299ddff1ae78080044316fd05a8140e84268eaa19afd4","observation_id":"021cd0f7-d840-47b3-8c66-3da4436da40f","resolution":{"observed_at":"2026-08-07T11:02:06.253737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:02:06.316628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.316628Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:e1f4ec05f111bc8968f3cee9a5ddd0cb698085e3ff331334d4779606ba3f2f00","observation_id":"278d5873-5cb0-4a49-9743-51503a2c6db3","resolution":{"observed_at":"2026-08-07T11:02:06.316628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.802331Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"e25ae95f-ec74-473e-9cab-c37cf9719175","year":2017},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.418454Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:60582e2e867e6ef6a1902223c9505a8f2237fc79bc6925744ca7fe1fc1190e4b","observation_id":"506c2480-27e3-4056-99c5-e9f62e8b0607","resolution":{"observed_at":"2026-08-07T11:02:07.849690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.667823Z","title":null,"venue":null,"work_id":"b583ea4f-0adc-4898-b3bc-ef4edfef463a","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.439878Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:b6d75c2b08b943c089ae952fd542e5efe45043830a1a065243dc188ca591bf88","observation_id":"1846d53c-b3b9-4f6c-9bc2-48c605c6bd6b","resolution":{"observed_at":"2026-08-07T11:02:07.720267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.489135Z","title":null,"venue":null,"work_id":"02a9ff4b-22a5-4bd2-ad03-08cd93f1ae4c","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.518607Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:4a14ac1c2ad3e29f9382c083d5a887b5c23aa908da6bd185688eba47cefe2411","observation_id":"fe41da30-b4ae-4b58-9377-a0e081c01675","resolution":{"observed_at":"2026-08-07T11:02:07.544416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.364109Z","title":null,"venue":null,"work_id":"a7a25b91-2d49-441c-bfa4-1bd73b3dfd46","year":2021},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.573293Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:c08fb4faa88d6cbd23b86f7e21dd29e97ac02245c4ded55d52a7ce3a8e9c55ea","observation_id":"ddc8d0ca-50c3-45ef-a434-20a8ff9bf490","resolution":{"observed_at":"2026-08-07T11:02:07.398972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.641375Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.641375Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:841b612ee85a7796c5aa14c478746e9af92630a9e1968b417a412ddd182bb343","observation_id":"59ea2b8c-d92c-4212-a389-188e2193faa0","resolution":{"observed_at":"2026-08-07T11:02:06.641375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T11:02:06.724922Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.724922Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:9b37fa542e30eee689c5a612affd045171daa77b10f3bae50c72b02f78f15992","observation_id":"6cda7c7b-bc8c-4d0d-ace8-78f47016516f","resolution":{"observed_at":"2026-08-07T11:02:06.724922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:07.229597Z","title":null,"venue":null,"work_id":"97aefcf4-5016-41f4-91cf-c2cfbce191b9","year":2024},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.766845Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:6ef025755f4fd58d7e939e3781c15be921efe7d12f2a104c6cb07455481529c8","observation_id":"7774c5cb-9d47-42bb-b53c-feb9af6ff620","resolution":{"observed_at":"2026-08-07T11:02:07.281279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.827191Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.827191Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:8fef3161f1f0affdd683349d9edcc015d6dd1bfe87ca2904446e241ffbe3bf56","observation_id":"ed8a2307-3cca-41af-84fe-97dbe00d64fe","resolution":{"observed_at":"2026-08-07T11:02:06.827191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:02:06.917838Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:02:06.917838Z"},"links":{"citing_paper":"/paper/2506.03762"},"observation_digest":"sha256:bd15919e5d1ed5a6241ae50e7ec9daa3f19e928643d8e61751e7bb3b63ef744d","observation_id":"be8b3cef-6f92-474b-91ab-dd542f32483d","resolution":{"observed_at":"2026-08-07T11:02:06.917838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03762","last_updated":"2025-06-04T09:25:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T00:13:16.491195Z","submitted_at":"2025-06-04T09:25:53Z","title":"AhaKV: Adaptive Holistic Attention-Driven KV Cache Eviction for Efficient Inference of Large Language Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2506.03762."}