{"as_of":"2026-08-10T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ab10e05bb04cab7f6abdfec7e406d4045d0b5e6c94db66b6df965d768bfdc53","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:42.984625Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:45:12.553567Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T17:55:13.328095Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19586","snapshot_observed_at":"2026-08-06T19:45:12.553567Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04723","last_updated":"2025-07-07T07:33:24Z","snapshot_observed_at":"2026-08-08T04:19:34.064805Z","submitted_at":"2025-07-07T07:33:24Z","title":"LOOM-Scope: a comprehensive and efficient LOng-cOntext Model evaluation framework","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:12.553567Z"},"links":{"cited_paper":"/paper/2505.19586","citing_paper":"/paper/2507.04723"},"observation_digest":"sha256:8decdbac1d39e8fd9cde186c70053b5a6362d8b6339f0df725608bf16c581b79","observation_id":"c81e1b24-b203-471f-98e7-755364f2c47d","resolution":{"observed_at":"2026-08-06T19:45:12.553567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"cited_work":{"arxiv_id":"2505.19586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19586","snapshot_observed_at":"2026-08-05T17:55:13.328095Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","venue":"cs.CL","work_id":"5513fbf1-372d-4b64-a37e-eafa041e9116","year":2025},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:10.372511Z"},"links":{"cited_paper":"/paper/2505.19586","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:9b2c4fb4dc29807fbad7ddcc3be10fc7f400fc31c5b1a5aa444c542f1f1ef25d","observation_id":"06792c92-3127-4413-b66c-d107532327c0","resolution":{"observed_at":"2026-08-05T17:55:13.365091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19586/citation-record","integrity":"/paper/2505.19586/integrity","json":"/paper/2505.19586/citation-record.json","paper":"/paper/2505.19586"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:46.240055Z","title":null,"venue":null,"work_id":"0fe2d842-694a-4e23-85b8-43d19f5bdc85","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:38.963314Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:8e842a2a5e3b4951ac7ada3f422430309577145c8d70da413c95d30150689962","observation_id":"0009c9d3-4a69-441a-84cb-52e148f9e73e","resolution":{"observed_at":"2026-08-07T14:16:46.286667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:46.064402Z","title":null,"venue":null,"work_id":"cf337ce7-a74a-433c-8b42-001c046237a1","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.013330Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:aea5d3b872d8d732934374c5b687b25e83910225e486471ec999ea0228a4b3a5","observation_id":"e61ec203-ee94-4a34-acf9-b5da69754873","resolution":{"observed_at":"2026-08-07T14:16:46.145966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:16:39.105730Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.105730Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:50f8f844f65474d74122d4d53e3e4815d25d8f0938b2851696e335d113f370a9","observation_id":"56da942a-5538-4a0f-801a-95e2e1113a05","resolution":{"observed_at":"2026-08-07T14:16:39.105730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.190085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.190085Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:ec0fcba2259e7bd1f608a211afee3963039b33990070031874f24e6e57be5e60","observation_id":"bff1fdef-e70e-4e89-ae0f-f8f661f4b18d","resolution":{"observed_at":"2026-08-07T14:16:39.190085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-07T14:16:39.266790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.266790Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:c3018c882393cac988a3242ff2207058ef5115a97234477702436ba2019451c8","observation_id":"3da24f0b-5d7d-4529-b2cc-5e6e828b937e","resolution":{"observed_at":"2026-08-07T14:16:39.266790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.854816Z","title":null,"venue":null,"work_id":"24e070e6-6dad-431e-8d0c-861478d46a0f","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.358085Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:bafee8fdbc8c98b2adf13f4dcdd50d75b07be12f5d99a7ae7b6cb2f526a393a3","observation_id":"b0700a1d-b0be-4d48-a286-c8dc4035002d","resolution":{"observed_at":"2026-08-07T14:16:45.978753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.438404Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.438404Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:78d7c38dae09b8bbabde87fdacf0149b11600dee7e88399f20c26bbb084d858b","observation_id":"c358e741-9b03-4389-adaa-4897f3af5a9c","resolution":{"observed_at":"2026-08-07T14:16:39.438404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.530091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.530091Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:72920ec38b295c2c66aa3fbeea33149627258ec9d6c686bafa7bf4dc1ae47b3d","observation_id":"7917efbd-44f6-4c9b-adca-9457f47d1654","resolution":{"observed_at":"2026-08-07T14:16:39.530091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:16:39.619435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.619435Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4ae60ffb7ff9e077ffa7ef6203fd5dd62cd11cfc9c20509f4f3cff6be83909ae","observation_id":"050c77f7-e884-40c9-8c1c-5b1a9e8b8769","resolution":{"observed_at":"2026-08-07T14:16:39.619435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-08-08T13:32:33.116151Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-07T14:16:39.736272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.736272Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:6f024528e305f0ebad1a9813aed61841487ad26b7030a6dd4156f9f25023bc84","observation_id":"be925673-3d0b-4f96-ba40-04959777713c","resolution":{"observed_at":"2026-08-07T14:16:39.736272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.639767Z","title":null,"venue":null,"work_id":"e08d99fc-55c1-4409-b0fb-fc559db87320","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.882527Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:9b6881a1a4c711ede7fa1ac334a25b76edd3e23ab136ec4d5cfe0da2974292aa","observation_id":"e5b8f505-a5b4-486f-add0-f3ca2a95bc1c","resolution":{"observed_at":"2026-08-07T14:16:45.756652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.957230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.957230Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:f49ce8458b9925f7ca48e8482915710011a3fab85465ac60e2fabde59177b796","observation_id":"75d60ba6-1429-42b5-9726-e7d47c12acd8","resolution":{"observed_at":"2026-08-07T14:16:39.957230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.059217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.059217Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:dda3f41336e198edc60dddfbd14eb763f52a8622ea9348bc0ff6a7c480c33f7f","observation_id":"1d546562-dc02-475e-9b47-73266fb0ab03","resolution":{"observed_at":"2026-08-07T14:16:40.059217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.185668Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.185668Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:b25445b464e18e82dc2598a77d91072e3c374fdfac860009cdd253afb2eede47","observation_id":"4d09a508-089b-47bb-a5f2-97700cf23728","resolution":{"observed_at":"2026-08-07T14:16:40.185668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-07T14:16:40.300614Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.300614Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:38e6e6dbe6b48ddcbf355ecdb2c6cdb403d2d4c05a12312a9520a5455c29e570","observation_id":"7e68ccd2-51c8-47b1-a411-fa6b04f267a7","resolution":{"observed_at":"2026-08-07T14:16:40.300614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.399838Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.399838Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:69527d96df3bdeeb8ba8dceab8633090a935b9e00b9176e28adbc015635b4c26","observation_id":"83393d5b-049a-4ca5-bb72-3ce241205685","resolution":{"observed_at":"2026-08-07T14:16:40.399838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.533731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.533731Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:06930f654d2ac90cc07556ad7389c57a5a4db6bc4e4e9ba7f6620a52634891f2","observation_id":"0ba4e595-50ed-412f-a995-e05f8a7aeaea","resolution":{"observed_at":"2026-08-07T14:16:40.533731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.602920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.602920Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4d7a738c9e877c9995e7814feb5726182597911512664e2ec6b107fc4f8ed14d","observation_id":"9c533e52-2d32-4895-af8c-64dc29d1e3eb","resolution":{"observed_at":"2026-08-07T14:16:40.602920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.733388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.733388Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:8f619d755fc09dde1f05d2d57c43ae07a59fc600a86d87cf7afffef55536fc2d","observation_id":"2a066f05-082b-49cb-b01b-6ee0622ab53b","resolution":{"observed_at":"2026-08-07T14:16:40.733388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T14:16:40.840599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.840599Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:60c9d938e016ce25fca26f4fa035b0ee52ce63662769caab946ab87495b2f0f9","observation_id":"fd7275c9-816b-45ff-96c9-3afbc57e709d","resolution":{"observed_at":"2026-08-07T14:16:40.840599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.317763Z","title":null,"venue":null,"work_id":"5ac93e76-4c81-47ef-8acb-51e3517e80ba","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.929427Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:c55a4379e2066f47b892df5408a858d20991aedddc813a3d9f95ff0e20874e84","observation_id":"9a04388b-1d84-45e3-b2ab-1a747ca1e589","resolution":{"observed_at":"2026-08-07T14:16:45.426399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-07T09:13:28.333702Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-07T14:16:40.998220Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.998220Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:08364fe623149c0f2387a5d11866128246e1a47e8290805b6b7e8c1ef7e728e1","observation_id":"8cd1bf44-9bf8-486c-96b6-084e41673e6f","resolution":{"observed_at":"2026-08-07T14:16:40.998220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.033379Z","title":null,"venue":null,"work_id":"2cb35df8-7b3f-4c53-be0a-f13e2ba2e839","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.097932Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:d49734350517651170db51aa59c6f763c10c1de9a80a48eb28cf612ab9443f45","observation_id":"f66f4c85-15b0-439d-8ff4-9ce75c957d13","resolution":{"observed_at":"2026-08-07T14:16:45.178131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.831261Z","title":null,"venue":null,"work_id":"3be208b7-419f-43a5-81b0-29df352b3461","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.196983Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:a6ef8c31369f51b3afae7f0fb53533868a62ca2e731d81182e9e13dcb915d8b9","observation_id":"663a592d-2f60-412c-b8b6-82a99ede768d","resolution":{"observed_at":"2026-08-07T14:16:44.909157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.676561Z","title":null,"venue":null,"work_id":"d81c555d-c8f0-453a-9f14-4b927bbaa8f5","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.296524Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:f5bdb7e7fbd7f8b080a5353fc4a40d0e98aa4baae1f5c8b221a86b2dde594e70","observation_id":"a079a4d3-391c-45f9-b92e-54d21c51123b","resolution":{"observed_at":"2026-08-07T14:16:44.754722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.543876Z","title":null,"venue":null,"work_id":"cf3b644e-784f-44f8-a9b8-973859a8a427","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.372786Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:52dbfd4291d6bd1a88ef17462c143dc1e8c25c4ff936d1ab7cb1dac770bb89f4","observation_id":"1a8fe988-6039-4b96-bfdf-7a2269b3c748","resolution":{"observed_at":"2026-08-07T14:16:44.592866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.386013Z","title":null,"venue":null,"work_id":"1105c693-9d93-46b5-8106-18de44bca86a","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.464856Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:c71a91d7bbfc9495ec54b63d46e36bce8aa86ff1e9b9f979b24871682287e388","observation_id":"52e8d0bc-9369-454a-a3b1-c7267ef526cd","resolution":{"observed_at":"2026-08-07T14:16:44.434457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.202719Z","title":null,"venue":null,"work_id":"c293bd8d-8d53-452b-9a86-5b4a5d270f6d","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.553509Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:0ad9bfe2c8b9b77018beaeb90ffb0940da39059eb29f743b66ebb7ae595d9c32","observation_id":"83f3bebf-fe43-41b5-ae85-56d670b907ed","resolution":{"observed_at":"2026-08-07T14:16:44.304156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:16:41.649120Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.649120Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:de673063632c436c3f41cd53ea7b9299848db7f543779dac3b4955e267c62743","observation_id":"b100b888-b2b6-4049-839b-082a781e0eac","resolution":{"observed_at":"2026-08-07T14:16:41.649120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.001679Z","title":null,"venue":null,"work_id":"be951e2f-5799-4423-9f13-6be9117b7361","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.769077Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:1d019c105406ebabc7c848e85e6e784dc0e7639ddcbfaffd8367c2bea9824843","observation_id":"868b6744-535c-4cc2-8824-f3fd5b1dad29","resolution":{"observed_at":"2026-08-07T14:16:44.083353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01315","last_updated":"2020-08-25T15:46:13Z","snapshot_observed_at":"2026-07-06T08:18:46.549511Z","submitted_at":"2019-09-03T17:10:28Z","title":"Deep Graph Library: A Graph-Centric, Highly-Performant Package for Graph Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01315","snapshot_observed_at":"2026-08-07T14:16:41.882697Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.882697Z"},"links":{"cited_paper":"/paper/1909.01315","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:8374bf542e2ba2f87faf7702c7fa71bb879c59b18c8b18827fe54514242b2e0e","observation_id":"c4e447d9-8d09-4019-8676-3864b2e16da2","resolution":{"observed_at":"2026-08-07T14:16:41.882697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.789776Z","title":null,"venue":null,"work_id":"6887516d-1f67-49cc-9186-139772f431a9","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.976279Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:0e03144f6d8a101431162466b386cab355c2a69042d7aa9e79f41322ea4a3576","observation_id":"7924559a-cd26-4bca-b90b-b394ea4b6781","resolution":{"observed_at":"2026-08-07T14:16:43.891966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.590154Z","title":null,"venue":null,"work_id":"d71a70c4-0a7e-47d0-9f71-635e5e476a94","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.074404Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:eda53c430ab7d18c7b101e424f1e611ac44151691dab18eb1ca0bb7e98d6b913","observation_id":"0fa3dd3c-f37c-4e1f-a563-75bc8879d05f","resolution":{"observed_at":"2026-08-07T14:16:43.696181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-07-06T17:36:40.933805Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-07T14:16:42.177025Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.177025Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4f776a30e8e73a1395d36a7d63f21f48bc18bccfaf900bea45b167120a4313ff","observation_id":"e3a1e404-48ed-442b-abc8-6981acdd4d24","resolution":{"observed_at":"2026-08-07T14:16:42.177025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07092","last_updated":"2024-08-18T17:27:17Z","snapshot_observed_at":"2026-08-05T16:40:54.770070Z","submitted_at":"2024-08-11T18:40:36Z","title":"Post-Training Sparse Attention with Double Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07092","snapshot_observed_at":"2026-08-07T14:16:42.302352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.302352Z"},"links":{"cited_paper":"/paper/2408.07092","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:673364d93648e52d48a1864acda02e411b3dfde503be15a098a5ae1e195a21dc","observation_id":"8bae7c40-8cad-4de8-b326-6a4e6348b460","resolution":{"observed_at":"2026-08-07T14:16:42.302352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12820","last_updated":"2025-03-30T08:13:50Z","snapshot_observed_at":"2026-07-06T18:48:00.070861Z","submitted_at":"2024-07-01T13:05:42Z","title":"PQCache: Product Quantization-based KVCache for Long Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12820","snapshot_observed_at":"2026-08-07T14:16:42.391215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.391215Z"},"links":{"cited_paper":"/paper/2407.12820","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:9acc5b4d2badfe2662dd61783aa21d8f20b4772329030768080019f17a8eeee2","observation_id":"d06da1e1-b521-4fa2-8675-91a428ba9431","resolution":{"observed_at":"2026-08-07T14:16:42.391215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18934","last_updated":"2025-09-09T14:27:58Z","snapshot_observed_at":"2026-08-02T13:30:05.452811Z","submitted_at":"2024-12-25T15:45:18Z","title":"Dovetail: A CPU/GPU Heterogeneous Speculative Decoding for LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18934","snapshot_observed_at":"2026-08-07T14:16:42.476185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.476185Z"},"links":{"cited_paper":"/paper/2412.18934","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:10e4ada38d9cd4121246f8f1ee1e989ca69a705e826090d812982a51a1f214d3","observation_id":"32ac6e75-29cb-4ae5-8a7b-7d439bd44850","resolution":{"observed_at":"2026-08-07T14:16:42.476185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.573762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.573762Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:914c22b1ab5d9813b78b8701412130a1df9c3ca7ff2ec4ad7f43bfbde05f8f8d","observation_id":"11eb4041-968b-4b28-860f-0d80e8b8c153","resolution":{"observed_at":"2026-08-07T14:16:42.573762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13846","last_updated":"2026-05-18T05:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T17:58:14Z","title":"LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13846","snapshot_observed_at":"2026-08-07T14:16:42.683728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.683728Z"},"links":{"cited_paper":"/paper/2410.13846","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:cec0f2c06457d127bb4707217036e4c1c39c71c2e0401a51e093e24280c73c01","observation_id":"ceee1b52-8eca-48c7-8c1e-6345ac942997","resolution":{"observed_at":"2026-08-07T14:16:42.683728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.426640Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":"da201c99-ebc8-4f51-a4d5-8d653c90e612","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.793624Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:1a69f51b7ee1b73dc99f620858097f1851eb0dcba3a629854df03f6de3d72aa4","observation_id":"ef746939-1c9f-47a3-9895-200ca4c889e3","resolution":{"observed_at":"2026-08-07T14:16:43.494267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.896424Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.896424Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:2f143a9daedcbe55bc59de3b319c0a120473c3d1c60634d945fea54992e4527d","observation_id":"ba9f6c0b-ec83-4895-932f-6a81fdad01d7","resolution":{"observed_at":"2026-08-07T14:16:42.896424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.984625Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.984625Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:d6f21f192084b39b93b3af1068cb052c3b88a8585ed14a42e92e1ef921a8b63e","observation_id":"5a44742e-afbb-46f6-8f28-6abae5b91aea","resolution":{"observed_at":"2026-08-07T14:16:42.984625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T03:49:29.261093Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2505.19586."}