{"as_of":"2026-08-20T21:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2936e2648dc54272b7b68cf973504fb223c33f45053ded46c93d06ab488afcd7","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:52:00.853897Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09412/citation-record","integrity":"/paper/2608.09412/integrity","json":"/paper/2608.09412/citation-record.json","paper":"/paper/2608.09412"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.173244Z","title":null,"venue":null,"work_id":"c62f3414-58f2-4b44-8568-bd5ff17744ae","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.591998Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:27ffc79dfb802f0c05443264f0492022f7be4a301a3167fe12541e9e5ea46157","observation_id":"f6d9a7d5-758a-43e9-bec4-6a5a8346171e","resolution":{"observed_at":"2026-08-11T17:52:02.178979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.597747Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.597747Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:4fa6d63002f73093963394f123d8f030615820d669de257ac7ac9027b874264e","observation_id":"39a06924-9fcc-4274-a33f-eef2fa3a84e4","resolution":{"observed_at":"2026-08-11T17:52:00.597747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-11T17:52:00.602800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.602800Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:dae2ae8394857d2c1acde4eeaf7b3e09f993479f6a8c9d4dedb9a952529d7c71","observation_id":"7ee61a46-2ccc-4785-86ac-c54d5c6a1878","resolution":{"observed_at":"2026-08-11T17:52:00.602800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.156090Z","title":"Abdelfattah, and Kai- Chiang Wu","venue":null,"work_id":"a2cbacc6-9407-469b-91f5-b6f820af2974","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.608578Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:2546072643a26d32cd2abb09e259430d88b419ec454195e44babc39ebdad33db","observation_id":"21b5b955-6db3-42b5-882f-8ecd89b493ac","resolution":{"observed_at":"2026-08-11T17:52:02.161405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.1926","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.255890Z","title":null,"venue":null,"work_id":"57885ad5-5f8c-4d05-8c4e-be9dafbee444","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.613526Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:06dc04965515976ed6c8f05c6f944d5096d98508ed5bea096863a6e983bda62f","observation_id":"8a2d07e9-aaa8-42f7-96ff-0ee031729318","resolution":{"observed_at":"2026-08-11T17:52:01.262026Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.05929","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.235614Z","title":null,"venue":null,"work_id":"e40e2ff8-ed67-46fe-87b3-da7fd84d99f6","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.618876Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:95eb361f3195e9c29946137cf2256b18146134e99eeb3276a6f43971af3f39dc","observation_id":"9d8b0e76-0b55-4917-bfe4-7d977e81b7ad","resolution":{"observed_at":"2026-08-11T17:52:01.243790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.139931Z","title":"Smith, and Matt Gard- ner","venue":null,"work_id":"4bfd81c6-2883-4e34-9943-82f966dd6a0f","year":2021},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.624432Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:e9dce598a7b5c5fa882c2eaf3a3b78d7c0b782d5f4907aeab6be8386e207a3ed","observation_id":"7686fdba-16ed-46da-b59e-936bf90d41a0","resolution":{"observed_at":"2026-08-11T17:52:02.145125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.629188Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.629188Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:64ad3451be722f9b69a1ae8f4ef57f51ee185879a6cd3d022d13bc8a488c3d1a","observation_id":"5b5078d5-99b3-4997-b32d-dbae46ac4ef8","resolution":{"observed_at":"2026-08-11T17:52:00.629188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2606.15157","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.167976Z","title":null,"venue":null,"work_id":"d60e0e20-92da-4919-9177-4baad31d53d1","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.633932Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:25fd17849d51aaecd70db2ccbe37362f6185fc2351f6eaa2734a0c95fb49cf20","observation_id":"60f11893-714a-4efd-9e6a-adb2b5d3a40c","resolution":{"observed_at":"2026-08-11T17:52:01.172892Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20732","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.631141Z","title":null,"venue":null,"work_id":"536ca2f9-10ce-45e3-8c66-c7a71613b7d4","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.638825Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:851b70d1091081d9acd52c4c8a9229c3ec207cc45b929fca54183d4de55f5a12","observation_id":"f9de44c1-b5fc-4423-a18c-83da59d1b521","resolution":{"observed_at":"2026-08-11T17:52:01.640627Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.123255Z","title":null,"venue":null,"work_id":"d51fd9a3-cb72-4bb8-a6fa-87195f8aab51","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.643670Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:142cec01867c6d81d73f2bb2d3b02c011017fd3de7b5852c902d9f231f3df1d9","observation_id":"69b154ee-ce49-48c7-9b89-6aa06e59e4a5","resolution":{"observed_at":"2026-08-11T17:52:02.128387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.105433Z","title":null,"venue":null,"work_id":"5bb0d42b-b414-4798-8834-4f82762a56af","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.648755Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:0a29846e75916a6ab433bf5f1a23664ac676e73d0da0de8deb3406e4f54195ff","observation_id":"d4a27c5a-ca9b-45f7-ac66-36a29b08181f","resolution":{"observed_at":"2026-08-11T17:52:02.111065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.073292Z","title":null,"venue":null,"work_id":"71c90b43-7dec-477c-91d6-11db86ca863a","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.658852Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:b6bb2f26f636d7ae028fdad1aafd88de066b5a07138fc097194d3bcd85d3a3f7","observation_id":"214ddf50-703b-4ad0-bd55-b8bec102c4c5","resolution":{"observed_at":"2026-08-11T17:52:02.078320Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.057683Z","title":null,"venue":null,"work_id":"d31ffd03-f2fa-41d9-bbb9-8f0e6735963f","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.663686Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:4d9ba54f1b3b39ed533ebfb500010fc43919ae3a475352e3028d5d5a54258aa1","observation_id":"5b3a4406-4eec-4402-8296-24d70e33fe8b","resolution":{"observed_at":"2026-08-11T17:52:02.062449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05971","last_updated":"2026-05-12T06:42:09Z","snapshot_observed_at":"2026-08-15T03:37:56.193816Z","submitted_at":"2026-05-07T10:17:55Z","title":"Training Transformers for KV Cache Compressibility","version":2},"cited_work":{"arxiv_id":"2605.05971","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05971","snapshot_observed_at":"2026-08-11T17:52:01.544986Z","title":"Training Transformers for KV Cache Compressibility","venue":"cs.LG","work_id":"53d57f8a-8905-481e-b214-72ca0bc7ff11","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.668293Z"},"links":{"cited_paper":"/paper/2605.05971","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:aa3dba76c9bb7b850291b46ce02bdd5e8420775fe0492960ca09025d7982037b","observation_id":"09fc84c6-e45f-4a11-8b1e-aa4bcd7af639","resolution":{"observed_at":"2026-08-11T17:52:01.550202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02812","last_updated":"2025-03-04T17:37:49Z","snapshot_observed_at":"2026-08-18T01:06:00.742835Z","submitted_at":"2025-03-04T17:37:49Z","title":"Q-Filters: Leveraging QK Geometry for Efficient KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02812","snapshot_observed_at":"2026-08-11T17:52:00.673157Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.673157Z"},"links":{"cited_paper":"/paper/2503.02812","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:7c92d1fdd91944f54bd3692c5a98c26069979c707c782837652ec7d37e9e4aac","observation_id":"32dafbc3-72d2-44ff-bf79-73d8ae30ff45","resolution":{"observed_at":"2026-08-11T17:52:00.673157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.041681Z","title":null,"venue":null,"work_id":"900b2974-e1b8-46a5-bde0-ad3afa9e52ed","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.682557Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:0193ccf0247c3dd8efdfb1f7d494bd6663701304ccadb441f5044f49346bc236","observation_id":"1015d19f-d30b-48fb-987e-5b420f2e80d7","resolution":{"observed_at":"2026-08-11T17:52:02.046638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.692014Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.692014Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:3460f3ac37248f6c9cd4f1f7eb5deed8f0bf3e3e8d0922cf50818adeeabd180b","observation_id":"bb137bff-d39f-463e-9c0d-86c72e4d0c58","resolution":{"observed_at":"2026-08-11T17:52:00.692014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-18T14:33:16.365411Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-11T17:52:00.696471Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.696471Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:3bcfb334f3ff09fedf84884d59a39f103bd8a81ac6c9c6ff36fce80f90ebacc5","observation_id":"3215d4c3-c212-4ad1-9bfe-7ae360d8e8d5","resolution":{"observed_at":"2026-08-11T17:52:00.696471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.015144Z","title":null,"venue":null,"work_id":"e980937b-4fb4-4b27-99b9-5cdf32a09c34","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.701492Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:7820a7ec217cbba982fc678864dd08b7dae7fa4a9a53a934c92bfd0e816c207d","observation_id":"7911ba13-0e3d-4f50-a790-77e3cefaa519","resolution":{"observed_at":"2026-08-11T17:52:02.020089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.706070Z","title":"Chen, Xu Yuan, Ye Jia, Jiancheng Tu, Chen Li, Peter H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.706070Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:422696845b4de1b16044eed2f5ba91679716863efc4e4f0c9bd8b41d87aee7da","observation_id":"336f42a1-9b0b-4695-8ea0-2ffa1a81c9b5","resolution":{"observed_at":"2026-08-11T17:52:00.706070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.999170Z","title":null,"venue":null,"work_id":"6760b1df-b2d3-4f03-87d1-bdced41d3d8e","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.710682Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:2912438546d10397e0cbcef841f8d3943b4f43ed964bab9e9991d36f4d41263c","observation_id":"7749c6b9-f664-4d8a-9fa7-d5f82cb30657","resolution":{"observed_at":"2026-08-11T17:52:02.004432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.983206Z","title":null,"venue":null,"work_id":"beac098e-df5e-478e-8dd2-7b611bb3c5d4","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.715122Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:02c89f7b7c8ee65cac6c03177ee720ca3aa81de682b956360f10a6ea5091656c","observation_id":"fe32416e-5fc2-4c28-b105-721bba83c045","resolution":{"observed_at":"2026-08-11T17:52:01.988164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-20T14:01:46.841630Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19442","snapshot_observed_at":"2026-08-11T17:52:00.719577Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.719577Z"},"links":{"cited_paper":"/paper/2412.19442","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:f020cff38932f387b06720366c0c0e52c08cd5ab1dea486d98f22e8b54339ef8","observation_id":"f4dda250-f2ae-49df-91ed-478f5276c0c8","resolution":{"observed_at":"2026-08-11T17:52:00.719577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.967469Z","title":null,"venue":null,"work_id":"79560173-dab5-423a-a483-6546e7aa43c9","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.724717Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:92964c19a2c244b738f4431423450d4d242d536400689ae1532a0f46678d0b42","observation_id":"ebd34dea-cb6f-491b-a923-1a740c145c59","resolution":{"observed_at":"2026-08-11T17:52:01.972153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.729147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.729147Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:fc43cfd214283518daef26fc6614cbb924eb76fe8584ffeff7e1f6418fd9b41e","observation_id":"e9a0b598-acf4-490e-9e9f-696d089044e8","resolution":{"observed_at":"2026-08-11T17:52:00.729147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.941423Z","title":"Abdi, Dongsheng Li, Jianfeng Gao, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"978d9c01-0f99-4139-8725-bdac63cf30ac","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.733662Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:2ab1830900fab763436418e9a36f724db44fa30ad53c037923f5059bf2b1239f","observation_id":"99f9ccab-2c6d-4331-aba3-97cfeaa11f87","resolution":{"observed_at":"2026-08-11T17:52:01.946410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.737885Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.737885Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:daedf9e05e789edf5a8b0ce41e91c72fef6e264e819786e90241829277a11be9","observation_id":"3264191e-8390-4b4c-9542-9872bc4da201","resolution":{"observed_at":"2026-08-11T17:52:00.737885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.742196Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.742196Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:579a6f53b6ad3ea005bc8d60e140689bfc8872206540310cd41c355d14ee1078","observation_id":"385cb84a-50cf-4462-a3ff-bf5f10eb0813","resolution":{"observed_at":"2026-08-11T17:52:00.742196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.925341Z","title":null,"venue":null,"work_id":"b2068c41-c146-4d50-a763-2a764adabc02","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.746552Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:1ab8b47098a1f4712c1d1a5955f1a4a6bf7cd347f275e062539d23855e5f2e98","observation_id":"e6a2c16b-6a3e-457a-b269-8a212c70f3ec","resolution":{"observed_at":"2026-08-11T17:52:01.930185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.751071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.751071Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:86cf30ac034f0348673eeb505718bf4432c1b2f2e76696fb19f5c3ee5aa2b26b","observation_id":"2fb0ec03-a93b-448f-95eb-7bcc642d504c","resolution":{"observed_at":"2026-08-11T17:52:00.751071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.755719Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.755719Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:67f7ac3a5736d4fcaf2b1ec94cb1fe74392a1256b3a3be85b6dec33a4ca25c24","observation_id":"2a89d93a-118d-4654-a627-33378b431fb0","resolution":{"observed_at":"2026-08-11T17:52:00.755719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.898417Z","title":null,"venue":null,"work_id":"6e6dbc74-1177-4e85-8233-ffca6bf70ef1","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.760572Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:77cec9ee668a5347eed67efaecd4a73abece928841fa75275d0996c5c38ca7a4","observation_id":"ff4a6c3c-f10e-4e03-8140-11176d46aa03","resolution":{"observed_at":"2026-08-11T17:52:01.903589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.882527Z","title":null,"venue":null,"work_id":"fc608d16-50dc-4b78-a67b-75ef137dd2e4","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.765260Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:1e38512beb7d3a5572c2caee282410d8db2b51d700681ea1cfe986917614397e","observation_id":"d2a9eb06-7a27-4450-a67c-2528fe7e4574","resolution":{"observed_at":"2026-08-11T17:52:01.887832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.866098Z","title":null,"venue":null,"work_id":"ad97c503-3c77-47bd-babb-c091d8448f29","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.769737Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:bd91bc234d818fb6304a97fadb4a58a6ec0029b4a9f552e28b4ca343a9cd6d51","observation_id":"7b9f5e3b-3c1b-455d-bb6b-9b1a106abc1a","resolution":{"observed_at":"2026-08-11T17:52:01.870839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.849835Z","title":null,"venue":null,"work_id":"62e88407-e92e-45b9-a14d-9c7762a370af","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.774730Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:238d272cce70cc259a0068b6e61d088e79ef7702df88fbcf1c5ed345e3678a7b","observation_id":"e85d80fb-4907-4188-97a7-9da3c6498c7e","resolution":{"observed_at":"2026-08-11T17:52:01.854789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.779497Z","title":"Morse, Raghavv Goel, Mingu Lee, and Chris Lott","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.779497Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:ea937fe824df0f83af922e1dfb325d200543cf4aa643c062aaaf4b5ff07f78fb","observation_id":"c7cbfa17-cb4a-4bbe-8255-102aaa859061","resolution":{"observed_at":"2026-08-11T17:52:00.779497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00024","last_updated":"2026-06-15T19:01:17Z","snapshot_observed_at":"2026-08-01T17:09:48.094858Z","submitted_at":"2026-04-15T06:55:14Z","title":"ART: Attention Run-time Termination for Efficient Large Language Model Decoding","version":3},"cited_work":{"arxiv_id":"2606.00024","doi":"10.48550/arxiv.2606.00024","metadata_source":"pith","pith_arxiv_id":"2606.00024","snapshot_observed_at":"2026-08-11T18:16:15.004306Z","title":"ART: Attention Run-time Termination for Efficient Large Language Model Decoding","venue":"cs.CL","work_id":"2415bee6-c4de-4ada-ba48-79185d73f0ec","year":2026},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.784007Z"},"links":{"cited_paper":"/paper/2606.00024","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:85d2201bb8347c34ab39981a568d52c1e3b6a65bda81fde7441f8460f31bad13","observation_id":"a5036285-a570-45d5-812d-d9309f67bd33","resolution":{"observed_at":"2026-08-11T17:52:00.952075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-11T17:52:00.789323Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.789323Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:6c37ec9c544f7af6bf2fe03b65631968c46d783849c7e32d7aee191a4ba906a4","observation_id":"d06336bb-2546-4dcd-bc09-b78a920259cd","resolution":{"observed_at":"2026-08-11T17:52:00.789323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-08-16T13:31:06.995791Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-11T17:52:00.794462Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.794462Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:423fbf14296916c0d4b7882d9ac2c0644feb0cbccdeaa5455bc4d65eee8bbcba","observation_id":"7f9d27ab-a6ec-4cb4-b4e3-a59308de6cc1","resolution":{"observed_at":"2026-08-11T17:52:00.794462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.833305Z","title":null,"venue":null,"work_id":"723090f3-a5cd-46bd-96e3-8b0ed8a1e67f","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.799907Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:91a7db7482d466110cddfbfcac570fdb5a929815101b53e75a99cd3664987a83","observation_id":"62a917c2-e99f-4a25-a52a-55cc9ff99cb9","resolution":{"observed_at":"2026-08-11T17:52:01.838218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.804951Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.804951Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:da1cc05a5e447e447c8677abe009560404e1336bdbae79483a2f03544a42eb6d","observation_id":"4b6f066d-c2d6-40cc-9913-782044485626","resolution":{"observed_at":"2026-08-11T17:52:00.804951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.817138Z","title":null,"venue":null,"work_id":"458d773c-f515-43d6-b920-935623ff62fb","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.809615Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:4c3d506f27c4725e47a0c59376cfef66c21c0453737d3d7be83bbd34897b2e7e","observation_id":"24d49b3b-a39b-415d-8f7d-7ab17348e3c3","resolution":{"observed_at":"2026-08-11T17:52:01.821987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.784452Z","title":null,"venue":null,"work_id":"40931b39-46bd-4f64-b8af-f57e0c8b15e3","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.819288Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:8cdc199d063155a559b20d5fcd60dfecc45053efa338497c9ef495bcd1a4ed05","observation_id":"61a82812-6e7a-4328-97f0-7b35c4c9ec57","resolution":{"observed_at":"2026-08-11T17:52:01.789605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.768442Z","title":null,"venue":null,"work_id":"38d07e63-22d2-471f-9548-fec70f15894b","year":2025},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.824210Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:40be4508ea0ead06e865dc0e11157d54ab48f5a05475c144b58537e5e553b16d","observation_id":"8458a00c-6d92-4100-a3d6-e37af2500a68","resolution":{"observed_at":"2026-08-11T17:52:01.773581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.800431Z","title":"InProceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":"6d5b35d0-29ad-4414-b5e7-c5bb890b8239","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.814430Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:a6cc203e301ff232782aca5257c756d3deadc53098dbafdbe3484c157aa02a59","observation_id":"d5c3beb0-2d98-42a6-bf15-b2c617a37287","resolution":{"observed_at":"2026-08-11T17:52:01.805727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.833700Z","title":"Cohen, Ruslan Salakhutdinov, and Christopher D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.833700Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:ab53886f0346094806a525bc3b95bbba8df5637926ca075a1f058502ad97a218","observation_id":"04791667-0b41-4b96-b68c-2b7a63f7565f","resolution":{"observed_at":"2026-08-11T17:52:00.833700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.838505Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.838505Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:20fe18dadc0b15786fe476e8b1f25928a1cb3b99b48b40899fbbe449e2260d24","observation_id":"64803089-c290-42ef-93e3-2c25eead7c1d","resolution":{"observed_at":"2026-08-11T17:52:00.838505Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-08-19T14:43:57.922914Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-11T17:52:00.828953Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.828953Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:5da4fa7279c692d9c630d2480b5a0f25560ae05f76b6c2015988278c394edeb5","observation_id":"612c7258-afb4-4260-998a-ac8de40bc375","resolution":{"observed_at":"2026-08-11T17:52:00.828953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:00.848881Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.848881Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:57961064cbe2fa358b52471b4dc664f86efd047aaff2ee9d38b8f07120ca92dd","observation_id":"d9ec162f-6706-4f4c-8a22-2dc40b3583e8","resolution":{"observed_at":"2026-08-11T17:52:00.848881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.739428Z","title":null,"venue":null,"work_id":"aa4a3daa-3ab7-4ac9-959b-593e843878fa","year":2023},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.853897Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:4062576971359e748db2d3b3fce4715f16050f5e81d3baa258066b5b20a23887","observation_id":"39bf2860-f209-48d0-9008-dc551e3f7e2b","resolution":{"observed_at":"2026-08-11T17:52:01.744592Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12820","last_updated":"2025-03-30T08:13:50Z","snapshot_observed_at":"2026-08-17T00:49:15.253403Z","submitted_at":"2024-07-01T13:05:42Z","title":"PQCache: Product Quantization-based KVCache for Long Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12820","snapshot_observed_at":"2026-08-11T17:52:00.843537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.843537Z"},"links":{"cited_paper":"/paper/2407.12820","citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:8b3fcb137dc041a6db6a4df0ff5a4aacc80335731fc3d0a2b21023056a89f848","observation_id":"f6ad7cb2-0fcd-4e4f-afbe-d48e76cc5981","resolution":{"observed_at":"2026-08-11T17:52:00.843537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-2181","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:01.094695Z","title":"https://doi.org/10.52202/079017-2181","venue":null,"work_id":"56725eef-9e64-45a6-bb0b-ebc83db050e8","year":2024},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.687433Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:66f4c8be44eb42af061143c3844a94000fe17c16a39ed7f0bf9718a55bffd113","observation_id":"47c75fc6-fd45-43e0-87cb-ccc0e7dc592a","resolution":{"observed_at":"2026-08-11T17:52:01.100081Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:52:02.088875Z","title":"InInternational Conference on Learning Representations","venue":null,"work_id":"b787a9c0-467b-495a-9ece-0ea55235f736","year":null},"citing_paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T17:52:00.653874Z"},"links":{"citing_paper":"/paper/2608.09412"},"observation_digest":"sha256:db0d9ac9b6f9248ba390217750579d3b9593e00c220b85110d8ca93d244ba184","observation_id":"a7913608-c8d7-4a10-a7ad-191f2595d70a","resolution":{"observed_at":"2026-08-11T17:52:02.093950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09412","last_updated":"2026-08-10T10:38:05Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T02:28:04.268971Z","submitted_at":"2026-08-10T10:38:05Z","title":"KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":7,"verified_fuzzy":5},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2608.09412."}