{"as_of":"2026-08-19T03:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c29a5e94c3da308a43198a04a7ed4985c17f47eac8417f8acb978fc6507611ff","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T11:52:50.864071Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T10:41:08.967261Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24786","snapshot_observed_at":"2026-07-14T10:41:08.967261Z","title":"CONF-KV: Confidence-aware KV cache eviction with mixed-precision storage for long-horizon LLM,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10582","last_updated":"2026-07-12T05:35:26Z","snapshot_observed_at":"2026-08-16T19:36:08.444701Z","submitted_at":"2026-07-12T05:35:26Z","title":"MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T10:41:08.967261Z"},"links":{"cited_paper":"/paper/2605.24786","citing_paper":"/paper/2607.10582"},"observation_digest":"sha256:7186d3eda8ab47163f49dd8ee738148188b05f5822a46acb9dce6248d465813f","observation_id":"9b41a0b9-8670-4a03-8d63-59bc1651e080","resolution":{"observed_at":"2026-07-14T10:41:08.967261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.24786/citation-record","integrity":"/paper/2605.24786/integrity","json":"/paper/2605.24786/citation-record.json","paper":"/paper/2605.24786"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:aa55c97f80b8fa494a4dd7e6a251974fab893a68d6c70486bd6e41bbb7887989","observation_id":"a1bc029c-2c26-4abd-9883-38f9899bba81","resolution":{"observed_at":"2026-06-30T11:54:38.180010Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.909610Z","title":"Don’t waste bits! adaptive KV-cache quantization for lightweight on-device LLMs","venue":null,"work_id":"e2710583-23cb-4585-8edc-e7caf67d55e2","year":2026},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:41fd6e2b0555f4d66943737fe5915aaa5450dbab14195941127d9617ed7baa2d","observation_id":"c17f3790-9252-48b8-8446-e0d1ec4cd2a8","resolution":{"observed_at":"2026-07-09T08:06:04.910956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.920773Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"edbf28fa-6c2b-42a1-a79a-ab4c981502d2","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:b34e5e9484a82b93790b39ac5a2a7065fb7c24120aa4dc1adc5ff061757c3812","observation_id":"936ac0db-5d5c-4b52-8df5-32a70327af2a","resolution":{"observed_at":"2026-07-09T08:06:04.921912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":"2406.02069","doi":"10.48550/arxiv.2406.02069","metadata_source":"pith","pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":"cs.CL","work_id":"6317700d-f903-4ce1-8f53-b43cb146d48b","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:9f51220c23fa7645057691ca289553a6f70dc91239a03c5ceeb0bba20a7b3e2e","observation_id":"6cb3f8bb-9b81-41a5-a48b-b3de21a55b6d","resolution":{"observed_at":"2026-06-30T11:54:38.177115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.455817Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"3c743fc7-8c9b-4a72-ad8a-26c5a7636140","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:58c0b9eff27ea63a8311ab1881a68d3e08097dcec7b0f0dd74c91a9d2a0fcbee","observation_id":"dc8d1351-2e37-46a3-8edb-8f73e70e7303","resolution":{"observed_at":"2026-07-09T08:06:04.929325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:50.752282Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"1cf6266d-32d5-4dff-91d5-07b87fc70d1e","year":2022},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:66934b41c404375e998876a4d19b2b813a5c53265369c14594b9f4387b18c33f","observation_id":"641b5c0f-e1d9-4a60-a41d-e9d1e67cc7c4","resolution":{"observed_at":"2026-07-09T08:06:04.931052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.933254Z","title":"Kevin Zhou","venue":null,"work_id":"affe53a3-5182-423d-bd84-81140f200b55","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:9f434e64563979d40a52263212eeddf1032634a2e04c4d33d0aa76b93fe26271","observation_id":"909b1b3f-23ba-48f0-a06e-d52acd190257","resolution":{"observed_at":"2026-07-09T08:06:04.934358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.926213Z","title":"Model tells you what to discard: Adaptive KV cache compression for LLMs","venue":null,"work_id":"02773985-bbec-4f6b-bd13-255ccc495b18","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:7acdbd9974a87dcdfd3a29b89a96a8e9c104a20319c42f7da34825d1e319677e","observation_id":"f107b549-213c-433a-b995-53616b3c2761","resolution":{"observed_at":"2026-07-09T08:06:04.927548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:49.805633Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"78953019-8f03-471c-b366-c2ade0049322","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:5301daabbadf92526bf02c02d9936f107d05771236af6249f63891fd70f952c6","observation_id":"0b79e633-e71b-4028-9780-cbe1cee68b58","resolution":{"observed_at":"2026-07-09T08:06:04.939878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.924461Z","title":"Needle in a haystack — pressure testing LLMs","venue":null,"work_id":"bf333483-e813-4dbd-95c4-63f05d970a5d","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:6ea7c15f1a1ea57d4d609bc16fde0d1157ac776a937d79fcb8cf5eb830ef37ee","observation_id":"e1d9e33d-82e6-4438-bee2-0f3608a74bc1","resolution":{"observed_at":"2026-07-09T08:06:04.925707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.922589Z","title":"VisualWebArena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":"fe40de9b-4f11-4ef9-b9f2-112b40482399","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:f777e2e30581f6089d4f7e6626691cb93162cef4c3850c0d8900cec16b01eac3","observation_id":"237a378f-5692-49ea-b0ed-094b92a47f0b","resolution":{"observed_at":"2026-07-09T08:06:04.923919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.934908Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"32e54831-94f6-4594-aeb7-5f8a27691888","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:5d11e1a8b19153e231811021980d3ba4f27d38f412d7636277efe48ac47f7e28","observation_id":"0af25a82-f27e-49c6-90f6-edb0fcdb56df","resolution":{"observed_at":"2026-07-09T08:06:04.935985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.913384Z","title":"SnapKV: LLM knows what you are looking for before generation","venue":null,"work_id":"a8e810f0-c233-45fc-b3ce-94e50d2b9d8c","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:bb849641ed49f385677a5b84c630c6e558050e5938227b1616154f09df878403","observation_id":"b7a13331-c404-410f-9386-a80dbbc0cbe8","resolution":{"observed_at":"2026-07-09T08:06:04.914598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.915103Z","title":"Scissorhands: Exploiting the persistence of importance hypothesis for LLM KV cache compression at test time","venue":null,"work_id":"36d97233-640e-4eaf-871d-241f89ca5991","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:052431514239b7fa28c6060a94ea2b5a7e228d3835e523b5dcda6e0112bedfe1","observation_id":"c0ce2a79-b786-4449-8e17-c83d845f1f43","resolution":{"observed_at":"2026-07-09T08:06:04.916347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.916918Z","title":"KIVI: A tuning-free asymmetric 2bit quantization for KV cache","venue":null,"work_id":"d8c3c392-76d5-4160-935c-6e91ab70b2f4","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:9b8721d8016f3d6e8ce37de7a5e2886700c955c2172598a5bae623e1f96e7b49","observation_id":"b38c4277-fda9-422d-9f2a-cf8726c25072","resolution":{"observed_at":"2026-07-09T08:06:04.918376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.936755Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"21acdf5f-9104-47d4-bd74-669e5604f099","year":2017},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:def9090ac222b8f4b90810395ecc433e33a662d813347c57e407210cb1085500","observation_id":"7d12ed73-7d97-4316-8c85-bfd7b3428f0a","resolution":{"observed_at":"2026-07-09T08:06:04.938125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.907589Z","title":"SpecInfer: Accelerating large language model serving with tree-based speculative inference and verification","venue":null,"work_id":"5e395e8a-4b08-455e-938e-44d9d601fe6c","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:87d56e22b1a56328db16e2efe131e2ed4a6999ca2ef13726c9c4c0649e202d03","observation_id":"3490ae96-86a2-406a-9f75-e829982ce10a","resolution":{"observed_at":"2026-07-09T08:06:04.908972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.949547Z","title":"gpt-oss-120b and gpt-oss-20b model card","venue":null,"work_id":"9d7c8bd3-ca0f-472f-a60c-b858aad6d573","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:b0a247c26d8badbf65da5bd63ffc895f03c12f81583bd9fb389041f51eb798a0","observation_id":"120e942b-0291-4d91-a5bf-737daeba8ec0","resolution":{"observed_at":"2026-07-09T08:06:04.950715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.911438Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"03adf024-9e9f-4c25-9b7e-ed30760b020f","year":2019},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:54207f69c14adc80fa759e16351fba3d2415b178001e5c5c9523e6fae50079ba","observation_id":"ac59b018-36da-4654-bf43-a9abe4f800a4","resolution":{"observed_at":"2026-07-09T08:06:04.912724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.918916Z","title":"SparQ attention: Bandwidth-efficient LLM inference","venue":null,"work_id":"de2d3458-d441-40b9-b839-06fe278a5269","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:2b137b76dcc1a83601f42aa43ac6a2bb48442683c0cdc4ab214cd31426fa1732","observation_id":"1b2c2939-76c0-4124-9fea-5f7d70d2c013","resolution":{"observed_at":"2026-07-09T08:06:04.920264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.931538Z","title":"Tran, Yi Tay, and Donald Metzler","venue":null,"work_id":"ec824e2b-f888-4c9f-83d9-b2b2b8de05d1","year":2022},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:03073240c9270580afdb8e70b687e0c0b083ebd937c82e1cb0a92b9910570c06","observation_id":"51385273-83b5-4d4b-bd22-7ab2a4d072fb","resolution":{"observed_at":"2026-07-09T08:06:04.932662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.945525Z","title":"Quest: Query-aware sparsity for efficient long-context LLM inference","venue":null,"work_id":"4ba6ee47-3aa1-4432-ac07-75bd2998bf4e","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:bd40f919818bb72ddca482ec015b59b1ffb5b2d207dbdd478dff85528141418a","observation_id":"e5bb450e-3763-40a6-ae8b-aa86de536add","resolution":{"observed_at":"2026-07-09T08:06:04.947048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:50.067047Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"153fd63e-49a6-41a2-ae73-882541c89257","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:8a28da871a3abbc64eef09c4629bbcd4e36a25785e0422f15c33824d61f2e469","observation_id":"26294ba7-a41b-41ff-bbb9-da6889a95bbb","resolution":{"observed_at":"2026-07-09T08:06:04.948943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.943861Z","title":"UNComp: Can matrix entropy uncover sparsity? a compressor design from an uncertainty-aware perspective","venue":null,"work_id":"7af1dafc-3b6e-4a41-bc43-ca7137c6513d","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:8bf2f73078ae8213d8ee9231da42217c8b45da0f44af4ce69eaf0e81f15e6722","observation_id":"290d5321-04b0-417b-a409-aed13e10db3a","resolution":{"observed_at":"2026-07-09T08:06:04.944997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:66d3a9cee170140512b40cf2ee8c958dc46935a7832d20b22dd17a282068134f","observation_id":"6eb7760b-962b-459e-92b9-0945d84f751d","resolution":{"observed_at":"2026-06-30T11:54:38.184689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:49.708611Z","title":"H2O: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"bfb332dd-b361-4b48-8344-2a3bb200d983","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:bc198420587b79b579656701ba5b61edd5e08d986da37522317ff4710cc9df93","observation_id":"54c63ac9-97eb-4811-aa6a-22b6294eff83","resolution":{"observed_at":"2026-07-09T08:06:04.941651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09036","last_updated":"2024-12-12T07:52:56Z","snapshot_observed_at":"2026-08-17T22:49:01.152893Z","submitted_at":"2024-12-12T07:52:56Z","title":"ZigZagkv: Dynamic KV Cache Compression for Long-context Modeling based on Layer Uncertainty","version":1},"cited_work":{"arxiv_id":"2412.09036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09036","snapshot_observed_at":"2026-06-30T11:54:38.180786Z","title":"Limitations","venue":null,"work_id":"76372867-6fa9-4de9-be17-344cb47eadac","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2412.09036","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:26272d7666b3d38e9eb624c014094c6d772e0eb7505a3248e337f7302ed8fe3c","observation_id":"fd1b4ba8-56e7-44b9-ad00-d1000099beb8","resolution":{"observed_at":"2026-06-30T11:54:38.182377Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.942138Z","title":"Justification: The work does not involve human subjects, so IRB approval is not applicable","venue":null,"work_id":"97b0b4b9-3c6a-41f3-b7c5-a969781a6712","year":null},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:68a1765af54fe839b45848572731eb1b80b33da6f16e60f29e664ee0837aab1c","observation_id":"4db70534-4856-471a-9c90-e36e08fb79f2","resolution":{"observed_at":"2026-07-09T08:06:04.943280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":24},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2605.24786."}