{"as_of":"2026-08-10T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab717db07d7099ab7e70b7f879fe15abf82c182c114acb14c69dc92a6b68ac2c","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:10:01.390805Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06517/citation-record","integrity":"/paper/2507.06517/integrity","json":"/paper/2507.06517/citation-record.json","paper":"/paper/2507.06517"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.141523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.141523Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ed037eea61f999c5b5b7347c150e15b1b61e798647f688f2e2e338f9c3d7d2fe","observation_id":"2f23e687-b51d-4007-9a7d-c401816796f0","resolution":{"observed_at":"2026-08-06T19:10:01.141523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.149847Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.149847Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:0af7a9113e13cf82bb3af826325ba69828ae1ee4b94b3478eee234b6053d4262","observation_id":"dd74c056-2c14-4c44-8a9b-ab95831d2caf","resolution":{"observed_at":"2026-08-06T19:10:01.149847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.159355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.159355Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:d18e0b5a1ee2513d78160d5e59cc5470ffde04658ca9423ea3a41577eddd9caa","observation_id":"d2058252-854e-40fc-83a4-e0e736a0a99c","resolution":{"observed_at":"2026-08-06T19:10:01.159355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T19:10:01.168058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.168058Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:6c5c034a00d056ef2cbfc01b0dd2bb7298ba877187d8df62de01f8d2142fe080","observation_id":"909506b7-faec-4605-9ec8-43fbedf0c25a","resolution":{"observed_at":"2026-08-06T19:10:01.168058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T19:10:01.174335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.174335Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:f086391bfe36233f7091e859f57be03b3b6cdd7053de3361e36920337fbfe2b9","observation_id":"0948fccb-6ff9-4cde-894b-3291a937a64e","resolution":{"observed_at":"2026-08-06T19:10:01.174335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-06T19:10:01.179964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.179964Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:d7e10b5b5965a5c93a170673bcbf42d2e770da79b502541581aa5144d73d2245","observation_id":"18d9c572-7fdc-4e8b-bcc0-0d3fa60daa9b","resolution":{"observed_at":"2026-08-06T19:10:01.179964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T19:10:01.187348Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.187348Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ce3ed7af195d4d4a01acba7ce8d54f19050a3701b63f16cc4aa60f7a6a4bedfe","observation_id":"f927478e-2834-44c1-a324-84b6c04986a9","resolution":{"observed_at":"2026-08-06T19:10:01.187348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.195409Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.195409Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:10b4a8f24a5194240fc18fca2241c5c0b747d621d56c5c283ffa59441d90b1cd","observation_id":"a9a09754-ce12-4f78-a4eb-768cfbd703a5","resolution":{"observed_at":"2026-08-06T19:10:01.195409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-07T22:57:56.263839Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-06T19:10:01.203208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.203208Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:428b7e0268d41b15371db417c2077e3bacc3d05ed49db8b4bd26d0f041a23151","observation_id":"cfa7e96e-266d-4d86-a1be-924418abc8ab","resolution":{"observed_at":"2026-08-06T19:10:01.203208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14366","last_updated":"2024-09-07T02:52:29Z","snapshot_observed_at":"2026-08-04T12:08:53.387357Z","submitted_at":"2024-05-23T09:43:52Z","title":"MiniCache: KV Cache Compression in Depth Dimension for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14366","snapshot_observed_at":"2026-08-06T19:10:01.211946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.211946Z"},"links":{"cited_paper":"/paper/2405.14366","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:e9ac29076a5e05b08b51ca075dfac25c892468355ff185dca334a120efbcdeca","observation_id":"338b3950-8251-4c0f-99be-28abbd3377f5","resolution":{"observed_at":"2026-08-06T19:10:01.211946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.892306Z","title":null,"venue":null,"work_id":"1148b493-2162-4c67-8d66-877725b78872","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.219768Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:84a356dfa38c43441f13482b0b81b0fedb64de056c8ae69dc2863a7f36e502b9","observation_id":"9fdba2e3-31ff-42f0-8175-5110e941edf5","resolution":{"observed_at":"2026-08-06T19:10:02.958339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23924","last_updated":"2025-03-31T10:16:03Z","snapshot_observed_at":"2026-08-10T10:11:00.544652Z","submitted_at":"2025-03-31T10:16:03Z","title":"Model Hemorrhage and the Robustness Limits of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23924","snapshot_observed_at":"2026-08-06T19:10:01.234102Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.234102Z"},"links":{"cited_paper":"/paper/2503.23924","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a0b787ec7808a07cf6be9706d583826b0df15d1981690924678cea314aa55065","observation_id":"c95eb433-c79e-41b0-ad08-0d5889a4ebb0","resolution":{"observed_at":"2026-08-06T19:10:01.234102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T19:10:01.240080Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.240080Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:b170685c919e7508c16a3fdcf01f152576989fd3ebe5cceda17a85fa84571a1c","observation_id":"d6de484d-3952-42d4-bd55-90adf7f0a6a8","resolution":{"observed_at":"2026-08-06T19:10:01.240080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-06T19:10:01.245546Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.245546Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a3aac2a9c5f9f5ac705a601452396192701e2aa56d52644566c8fa28c4d7808a","observation_id":"cedb03dc-0ed5-417f-b6fe-93a3f06cca24","resolution":{"observed_at":"2026-08-06T19:10:01.245546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-06T19:10:01.252625Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.252625Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:e242c8b833b299be01295dfe13546b3d31a8fa0d107c471e5e83d377cc965ed0","observation_id":"5d68095d-1839-48b6-bb9b-f6b7f9013ff1","resolution":{"observed_at":"2026-08-06T19:10:01.252625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.736366Z","title":null,"venue":null,"work_id":"7d877cad-5684-4d89-9bf9-cc267cac0486","year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.259075Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:b17de75451c6a1d5a5f4bfed9414da71790f7652a9d07ef0f9fed9f1a80f07c7","observation_id":"66924c83-215c-41d0-b708-5ffa2f2154c6","resolution":{"observed_at":"2026-08-06T19:10:02.815580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.595278Z","title":null,"venue":null,"work_id":"33720ba9-83c2-4423-a27f-71efe2250551","year":2025},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.266524Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ed41824b041e0bb823d95b4519130faa042e9f3d37bf91d39d47e232ee89444d","observation_id":"3052772c-d3e2-4298-a07d-dbd0d9d2fce4","resolution":{"observed_at":"2026-08-06T19:10:02.657536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-07-06T18:51:49.871551Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-06T19:10:01.272177Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.272177Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ec51e75783f400557cbfb1f34bf3f55d98e6e93c26483728f70caa5287b33fd6","observation_id":"34f513a7-45ee-4117-9607-8b2ff82b929e","resolution":{"observed_at":"2026-08-06T19:10:01.272177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13212","last_updated":"2024-10-17T04:35:57Z","snapshot_observed_at":"2026-08-10T01:34:56.255406Z","submitted_at":"2024-10-17T04:35:57Z","title":"AsymKV: Enabling 1-Bit Quantization of KV Cache with Layer-Wise Asymmetric Quantization Configurations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13212","snapshot_observed_at":"2026-08-06T19:10:01.279099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.279099Z"},"links":{"cited_paper":"/paper/2410.13212","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:02bba6b92838cd5208b413a1857b3aacf6c1716cb2ef50f27e07abf3ae7173d4","observation_id":"a16d05fe-7f1f-41ff-bfe8-b04508726fb9","resolution":{"observed_at":"2026-08-06T19:10:01.279099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T19:10:01.285988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.285988Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:0508bd47e3383107a6cd6c70bb35bbd461fd393561183694bbe73394e7a1cfd0","observation_id":"a5583f0b-12c2-4186-8b24-9606c559e13f","resolution":{"observed_at":"2026-08-06T19:10:01.285988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-08T15:29:45.865074Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-06T19:10:01.293262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.293262Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:bfaa3d82fb11ea7985eb57a9892d6bde16e7606a571c209f02ac3ddf744ffdaf","observation_id":"e7596169-23e7-4742-955b-2e4a21a5c4fa","resolution":{"observed_at":"2026-08-06T19:10:01.293262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08454","last_updated":"2024-07-21T02:37:11Z","snapshot_observed_at":"2026-07-06T18:44:49.512236Z","submitted_at":"2024-07-11T12:50:42Z","title":"Model Tells You Where to Merge: Adaptive KV Cache Merging for LLMs on Long-Context Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08454","snapshot_observed_at":"2026-08-06T19:10:01.298502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.298502Z"},"links":{"cited_paper":"/paper/2407.08454","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:812a4cf79c31cfafb9d7d5c070ace894eeda3ea8a01e46f0581f680b3277a712","observation_id":"dd288fb9-7a4b-4fb8-b39a-a5dab284f6bb","resolution":{"observed_at":"2026-08-06T19:10:01.298502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.304251Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.304251Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:c5e64f2b992f53172588d6c87d86ea3955141ff481eff879d2a8766c1c480475","observation_id":"12ddd718-c7ce-4e1d-aa7f-fba1157d9910","resolution":{"observed_at":"2026-08-06T19:10:01.304251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.311005Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.311005Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:5fe76b5aaddfd25b627e04ecd7227885741a1b95c402236e545255b4f5d8cdfb","observation_id":"598a83f7-34fb-43d5-9443-2987dcd35c1d","resolution":{"observed_at":"2026-08-06T19:10:01.311005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.316923Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.316923Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:89477226aacb4adb7738d516db60d7534042667842cc9b00492fde4e4ff00041","observation_id":"ac18d532-b1fb-41e0-bca9-3365bec40329","resolution":{"observed_at":"2026-08-06T19:10:01.316923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T19:10:01.321670Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.321670Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:4b20be8d09609cbc38d246c66ef6a8b5716bde0f16949008cc916d5de4f53bcc","observation_id":"62fb2d66-e718-45ca-931f-b3977f2d1a89","resolution":{"observed_at":"2026-08-06T19:10:01.321670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.327165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.327165Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:4d5d5efb2fa42ecfdb6e0fc7015b3c4562054c429d88737e8294791f13cd63df","observation_id":"cc068d4b-028d-4e40-aeb8-fa23a8cb2e7f","resolution":{"observed_at":"2026-08-06T19:10:01.327165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-07-06T17:36:40.933805Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-06T19:10:01.332282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.332282Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:efd241b63f96a6257b7424a0ba4148b5f3aff6454bf8903d2fec50874ad32241","observation_id":"e3b232ec-8ee1-41d4-bc37-ec79c6e23609","resolution":{"observed_at":"2026-08-06T19:10:01.332282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10285","last_updated":"2024-08-19T05:17:40Z","snapshot_observed_at":"2026-08-09T20:19:46.135966Z","submitted_at":"2024-08-19T05:17:40Z","title":"BatGPT-Chem: A Foundation Large Model For Retrosynthesis Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10285","snapshot_observed_at":"2026-08-06T19:10:01.337858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.337858Z"},"links":{"cited_paper":"/paper/2408.10285","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:86e33a3764b70326262b0a9b1ed47dc35e4925d206fcd6fbea2adca20caf448c","observation_id":"8b3b2c85-1c67-4692-8799-445c095d568e","resolution":{"observed_at":"2026-08-06T19:10:01.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.204","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"cad586a6-0149-44bd-be2a-2164afcd330b","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.342595Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:b22d4c0445429205d44b2d431098e1a86f956cc02374f17debfabf0f7165f63c","observation_id":"07873f95-ec27-4261-9456-7458ae1c2872","resolution":{"observed_at":"2026-08-06T19:10:01.502841Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.347645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.347645Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a88a32793f35dc6d8ac0d10ae88dad4af96d49c233527f0769b195e4a69c1db6","observation_id":"c0dc3682-d4ee-42ea-bc80-c6e869a2ab90","resolution":{"observed_at":"2026-08-06T19:10:01.347645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.143","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"a3944fea-3704-4d73-b13e-1c40717cee11","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.352699Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ef44500811753fd42e64749c2e249d883bac2de5f221ea77ef267577573c92ea","observation_id":"27186367-5797-4737-961a-b045ba22433b","resolution":{"observed_at":"2026-08-06T19:10:01.461578Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.359336Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.359336Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ea18e485e0f94a8bd59ed4e16da2b77693e25963c109aef996aa8dfe54c895e5","observation_id":"a4760a97-6ed4-440c-a581-008cf9b4c222","resolution":{"observed_at":"2026-08-06T19:10:01.359336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T19:10:01.365544Z","title":"Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.365544Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:2fe5e3f969a6cb46e4e4523f21fcc3a8bb03ff6247c90a72ef31d4f6cb64c24d","observation_id":"881219f6-dd4c-46bd-bba7-279f8ef78d02","resolution":{"observed_at":"2026-08-06T19:10:01.365544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.372580Z","title":null,"venue":null,"work_id":"255b07d2-5d72-4644-b583-c70017991b59","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.371495Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:80ce8d6db5ba63ae6d3d8b11658368d5aba83f7efa1df65d905bdb13d572dacf","observation_id":"6fb9500a-4b9b-43bd-b9e4-c8d4a40a5711","resolution":{"observed_at":"2026-08-06T19:10:02.464695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.377937Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.377937Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:82989c46331ea9af84e5969479dc265bfc195d581985f90bdd70ec477e83c361","observation_id":"2a58ea80-198c-4d79-91a5-87f34443b4d2","resolution":{"observed_at":"2026-08-06T19:10:01.377937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.384792Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.384792Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:9369dcb723dee24d35e490842b4dcb8b6ad89b2290301e8ce9e158efd5d3a940","observation_id":"17425d81-1528-4a3d-b696-ece85a124c6f","resolution":{"observed_at":"2026-08-06T19:10:01.384792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.390805Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.390805Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:9ad050ca41e195c02c3cd9222e76727b296fbd68bf61cd6aa6ec04b7bacc1d2c","observation_id":"97ec6cba-9c59-477b-9854-08077b409f24","resolution":{"observed_at":"2026-08-06T19:10:01.390805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T09:11:28.813559Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.06517."}