{"as_of":"2026-08-13T07:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18a78a2b3f2716316cf016a8cb8b44c671623208d4df7631bb29808de7ea2877","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:32:37.769236Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08097/citation-record","integrity":"/paper/2608.08097/integrity","json":"/paper/2608.08097/citation-record.json","paper":"/paper/2608.08097"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-12T00:32:37.548174Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.548174Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:e27e11663eb89f94ea39d8e73c0d4060a274332110d135c52f29b94cb6924a44","observation_id":"af0bf56f-bea9-4b5e-a05b-06bc139976ee","resolution":{"observed_at":"2026-08-12T00:32:37.548174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.085971Z","title":null,"venue":null,"work_id":"73e9027b-51ed-4a31-80ca-0c2b1028371c","year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.553554Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:a2c75d38add25d602b05e4f186f22bbcedcddeff7292b467c5d9ebbbc93b0d12","observation_id":"937ab863-a18a-42ae-a550-4a1027d23276","resolution":{"observed_at":"2026-08-12T00:32:39.090364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/379","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.759088Z","title":null,"venue":null,"work_id":"f390f9dd-b826-440b-8b69-b669af9607c2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.558655Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:1fdd30ca077c4544b098e1d55a51d5c0e3c428bd808cdb7b7e8ab4f6ca153998","observation_id":"6eac5927-acb2-444f-ae13-9fd74da242e5","resolution":{"observed_at":"2026-08-12T00:32:38.764098Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-12T00:32:37.563550Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.563550Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:f8531fc937e9961b986bbcc4f408259c142567d9e0c6f0c41012ac9a50cbceb0","observation_id":"91792a2e-9c4e-4213-aa3f-fc6d13aa6f0e","resolution":{"observed_at":"2026-08-12T00:32:37.563550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-12T08:24:59.243273Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-12T00:32:37.568595Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.568595Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b6de56f4d6be3741ca1ab9b0a44ca90901c26cc7097d57ded48ce4433a1914dd","observation_id":"ccc1fac3-887d-4ef5-876f-b9b69b509e7b","resolution":{"observed_at":"2026-08-12T00:32:37.568595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.071502Z","title":"Hendryx, Zifan Wang, Chen Bo Calvin Zhang, Noah Jacobson, Bing Liu, and Brad Kenstler","venue":null,"work_id":"56a4f0e4-2c1d-4fb6-8c83-1d390f170c4b","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.573482Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5c5b9f1ff735adf95c1599bef9b16b7d3166590e6f66840dbd2010fc9d78206a","observation_id":"c7e8b1f0-4b3d-4ecb-a5e3-9373abf35d6f","resolution":{"observed_at":"2026-08-12T00:32:39.076004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.056920Z","title":null,"venue":null,"work_id":"2ce00280-3b3a-47f8-a523-0529ee3a1ef6","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.578640Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:d6cea25422440cf6b6e27a82439d0872620faf502b00f74a077d542601639a62","observation_id":"8eac5092-a1c1-407b-8f13-ce05c7903430","resolution":{"observed_at":"2026-08-12T00:32:39.061475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-12T22:21:14.844495Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-12T00:32:37.587787Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.587787Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:ebc2cfbe73f79e8179b882478edfd293dd3f28bd133e66d359e077d9d25e7a8a","observation_id":"38edf940-1fcd-4116-8a21-b25c5827e5e4","resolution":{"observed_at":"2026-08-12T00:32:37.587787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.042835Z","title":null,"venue":null,"work_id":"c97eae23-0326-4812-ad4e-475646f6c466","year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.592360Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:72191e62a5f0649ad38757a03599bcdde377fede803143de4cd26a1bf1282710","observation_id":"a018605d-1938-4fb8-81b5-005e03e0d0c1","resolution":{"observed_at":"2026-08-12T00:32:39.047160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.028507Z","title":null,"venue":null,"work_id":"570e3384-db6c-46c9-8496-56a5ca6ab02c","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.596804Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:75a55a34170372ff7897be578904b4fb30a739fd7efe683ba76543630f5f199b","observation_id":"2c61d42a-e2bd-4aaa-b41d-f29dfa8b0c6f","resolution":{"observed_at":"2026-08-12T00:32:39.032925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02490","last_updated":"2024-10-30T14:53:22Z","snapshot_observed_at":"2026-08-12T23:30:11.201041Z","submitted_at":"2024-07-02T17:59:56Z","title":"MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02490","snapshot_observed_at":"2026-08-12T00:32:37.605595Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.605595Z"},"links":{"cited_paper":"/paper/2407.02490","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:d1b6b933e00ea808c78b3a4c22cc3cc77dab2fb61b04f4bbca09629d89e7ca94","observation_id":"ac14ab7f-d113-4e76-9b76-816b3b767422","resolution":{"observed_at":"2026-08-12T00:32:37.605595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.22910","last_updated":"2026-05-13T05:25:05Z","snapshot_observed_at":"2026-08-11T06:44:06.632171Z","submitted_at":"2026-03-24T07:58:42Z","title":"EchoKV: Efficient KV Cache Compression via Similarity-Based Reconstruction","version":2},"cited_work":{"arxiv_id":"2603.22910","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.22910","snapshot_observed_at":"2026-08-12T00:32:38.593562Z","title":"EchoKV: Efficient KV Cache Compression via Similarity-Based Reconstruction","venue":"cs.CL","work_id":"7b0cc31f-b307-42ab-9d57-93ecf7a916e3","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.600976Z"},"links":{"cited_paper":"/paper/2603.22910","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b882a2f0a7619fac621a3b312293098d66fe5aa92fc0f34392f4ef955446de18","observation_id":"8c68286f-d414-45b1-8740-242bdbc633fd","resolution":{"observed_at":"2026-08-12T00:32:38.599090Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20766","last_updated":"2025-02-28T06:34:53Z","snapshot_observed_at":"2026-08-07T17:40:46.337382Z","submitted_at":"2025-02-28T06:34:53Z","title":"FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20766","snapshot_observed_at":"2026-08-12T00:32:37.614058Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.614058Z"},"links":{"cited_paper":"/paper/2502.20766","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:52f55a8f5fdc01229f87546250594b4eb42812dce038d80583fedb4f4a5031bd","observation_id":"78017947-a256-42b2-af92-388ef4ebc6e2","resolution":{"observed_at":"2026-08-12T00:32:37.614058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.013902Z","title":null,"venue":null,"work_id":"3046c845-dbf4-40da-9672-8f04ed9a94d0","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.609953Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:62dfcf52b501f6d618a7315d15e49241599abb280abd9d61835d3056e3b81e61","observation_id":"8d9f0df2-b4ba-4e0c-b6ac-3093900edb9f","resolution":{"observed_at":"2026-08-12T00:32:39.018204Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.998314Z","title":null,"venue":null,"work_id":"6b0bd302-2a48-433f-bb8c-c77b3e6a6f23","year":2023},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.623507Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:605915f172c13830da85c97430c881d820841bf56ce0dee6841f9e986ee5c0d1","observation_id":"6fd73aff-c8f0-43c4-a4eb-ac8ac045daa9","resolution":{"observed_at":"2026-08-12T00:32:39.003234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-12T23:33:03.580232Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-12T00:32:37.618708Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.618708Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:354926f3f0660e849030aed9c99de58c9d93929ab5fdf3c91dcf22f76e5d820f","observation_id":"fde42d2b-c679-4b89-b9d4-d136330f7f74","resolution":{"observed_at":"2026-08-12T00:32:37.618708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18071","last_updated":"2026-05-18T08:54:16Z","snapshot_observed_at":"2026-08-02T15:32:20.092680Z","submitted_at":"2026-05-18T08:54:16Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":"2605.18071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.18071","snapshot_observed_at":"2026-08-12T00:32:38.522268Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","venue":"cs.CL","work_id":"6e6ae37d-4fb0-486e-9974-c7f47184acb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.632695Z"},"links":{"cited_paper":"/paper/2605.18071","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:466cbb5acdffc86dc6c9de12d7d307658ee784e15bb7bf32e5f589e73bc3c484","observation_id":"f1af8768-1358-4810-8225-43936f42a85a","resolution":{"observed_at":"2026-08-12T00:32:38.527345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.980568Z","title":null,"venue":null,"work_id":"6d161668-56bb-4621-b39a-bb069805a55e","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.627988Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b4ab9b2e4802c28b0a91231037e40e72838d63d81b627a8346c9205c39c0a552","observation_id":"90eaca20-1378-4ee7-abee-fe8262d687d2","resolution":{"observed_at":"2026-08-12T00:32:38.987077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.963633Z","title":null,"venue":null,"work_id":"8433819c-9d67-414b-a427-c4d573f6ddb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.642228Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b30f9f6f25eafa86c1e1ad54fa3aedddf4cdf308a7a6ea4721545810ced0882b","observation_id":"329c59ab-7894-4f2a-b291-92dac0dd6381","resolution":{"observed_at":"2026-08-12T00:32:38.969312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.00101","last_updated":"2026-07-30T20:51:51Z","snapshot_observed_at":"2026-08-12T22:05:17.093446Z","submitted_at":"2026-07-30T20:51:51Z","title":"Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale","version":1},"cited_work":{"arxiv_id":"2608.00101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00101","snapshot_observed_at":"2026-08-12T00:32:38.501178Z","title":"Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale","venue":"cs.AI","work_id":"35ddbaf0-4d0c-4bfe-9fdf-8464c4953d5a","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.637449Z"},"links":{"cited_paper":"/paper/2608.00101","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:86b6ae2685785b706e94dbb611a300af46a66b9ea10e494910c490edd5936fc1","observation_id":"fa98d9e0-05c9-4048-8494-33111dac299e","resolution":{"observed_at":"2026-08-12T00:32:38.505931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.25852","last_updated":"2026-07-29T07:31:33Z","snapshot_observed_at":"2026-08-07T17:12:03.331999Z","submitted_at":"2026-07-28T15:25:05Z","title":"AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding","version":2},"cited_work":{"arxiv_id":"2607.25852","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.25852","snapshot_observed_at":"2026-08-12T00:32:38.388730Z","title":"AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding","venue":"cs.CL","work_id":"7d44d086-b23e-4123-b0e4-c22c0be3e132","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.651350Z"},"links":{"cited_paper":"/paper/2607.25852","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:4cea1090dd012e45eee51c858ea582793037ae44865a6a729f84a3e04bbca8b3","observation_id":"bb8e88f1-9d60-4275-92e9-ebbfc6a509e8","resolution":{"observed_at":"2026-08-12T00:32:38.393837Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.646859Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.646859Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:90996a18cfdc72983f875d15cb69d60c7b6d8a4f20a154477566ede991db2dc3","observation_id":"7340ac47-0189-4b09-a9d8-188fa296265c","resolution":{"observed_at":"2026-08-12T00:32:37.646859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.930786Z","title":null,"venue":null,"work_id":"7354e0dc-a09e-40fa-820c-b77279703fb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.659855Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0e5ab8abed2d89aefb446c826442d0bf001919b678ce93ce05b0d357b0518cf3","observation_id":"76cc6429-15e8-406e-8cb8-5edf2bfcd724","resolution":{"observed_at":"2026-08-12T00:32:38.935417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.946756Z","title":null,"venue":null,"work_id":"33969b08-e491-4124-9f15-cd6d47d226fc","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.655699Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0ee0a8722a6db94f77f9eb9c34f4001c4561c994c48bc2bf138d8fb88a51fbfc","observation_id":"956f4cbe-a696-466f-a363-0827e0387c53","resolution":{"observed_at":"2026-08-12T00:32:38.951813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.916037Z","title":null,"venue":null,"work_id":"3aabde6e-1274-497e-b0e4-a0e9eef2fff8","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.668311Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:6aad370c78f70567824b01837811a79a7aa8d9c4368904a8d65dc8d2cd770f4e","observation_id":"550cb5d8-15a7-4894-93e3-f5624139423c","resolution":{"observed_at":"2026-08-12T00:32:38.920419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.663878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.663878Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0e2e94bc195938fc23c8389e11b5c5aa78fb3a50987df64a360263b5433a73f3","observation_id":"f3a94a7a-f955-4c64-88b8-71a87606046b","resolution":{"observed_at":"2026-08-12T00:32:37.663878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-12T00:32:37.676424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.676424Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:688765141b97c2e4ecd7b403f4fa66620c281b749a6f7a1e637ee12c68a8a724","observation_id":"29f2e448-e553-43b8-b173-3b20bc724e73","resolution":{"observed_at":"2026-08-12T00:32:37.676424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.901663Z","title":null,"venue":null,"work_id":"a4d7984f-8e91-4770-924d-a625ab8d8a0d","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.672425Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5e1d4f0e95ec47a1e015877e845cb778e6d72259adbc027537cee3f87506a92c","observation_id":"e808feac-a137-4a0d-961a-ef5d0a3a755c","resolution":{"observed_at":"2026-08-12T00:32:38.906117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.685118Z","title":"Graham Lopez, Matthew B","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.685118Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:1fa32324478f7ff9007923ef36eedc25235106580842690d20b62ad61e725303","observation_id":"34de9866-6f3f-4ba6-ba4e-a08d451285af","resolution":{"observed_at":"2026-08-12T00:32:37.685118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.886939Z","title":null,"venue":null,"work_id":"d8ce996c-47cd-43cb-88bc-6630732b72d3","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.681078Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:1816406b5456c366f8d7c5474555a9bed39df66da9fb64f244fef9607d57c063","observation_id":"1972923b-11ba-4575-9ffe-b25ed95ee239","resolution":{"observed_at":"2026-08-12T00:32:38.891328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-12T00:32:37.694091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.694091Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5fe4d06e3cfa90bdb40c200d342e08fe7182723aa87570e86d326595e4efc3b0","observation_id":"18f2639a-c252-41ff-bc85-258af43f0643","resolution":{"observed_at":"2026-08-12T00:32:37.694091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21465","last_updated":"2025-04-25T19:40:54Z","snapshot_observed_at":"2026-08-12T22:13:26.137322Z","submitted_at":"2024-10-28T19:08:12Z","title":"ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21465","snapshot_observed_at":"2026-08-12T00:32:37.689283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.689283Z"},"links":{"cited_paper":"/paper/2410.21465","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:c6b94a196cb9a8bd4ea5d520e16a96f7f871d31792d7bda4669a5675fed6c771","observation_id":"3a033333-3dc6-44ff-94f6-e1e6a600920c","resolution":{"observed_at":"2026-08-12T00:32:37.689283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.845639Z","title":null,"venue":null,"work_id":"64f42f4b-dd3e-409d-85d0-56fccfe45755","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.703202Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0414f349c43ca78293b87062143ef7add949228f1babde6fee6165bae16f0bf7","observation_id":"1735977b-82d3-4f0f-b7b3-151147e1617f","resolution":{"observed_at":"2026-08-12T00:32:38.850226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.861011Z","title":null,"venue":null,"work_id":"28a9b9fe-36d2-4f10-bdd9-7d8237686bb0","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.698629Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0d1396ece6ff11d137968ff013712b1575265ebfa5011a79f03f52e461afe0ac","observation_id":"52ae3910-5989-4d31-9cbd-42caa94de572","resolution":{"observed_at":"2026-08-12T00:32:38.865753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14158","last_updated":"2024-08-31T13:33:22Z","snapshot_observed_at":"2026-08-12T22:57:30.987830Z","submitted_at":"2024-08-26T10:11:56Z","title":"Fire-Flyer AI-HPC: A Cost-Effective Software-Hardware Co-Design for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14158","snapshot_observed_at":"2026-08-12T00:32:37.711516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.711516Z"},"links":{"cited_paper":"/paper/2408.14158","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:3c5836f3b420a70e45c07dadd3f12339a7185136b3ea43e6883e276be4915717","observation_id":"84ba5465-a7bf-442f-aa8c-3bb71bcb65a2","resolution":{"observed_at":"2026-08-12T00:32:37.711516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09079","last_updated":"2026-07-20T13:38:48Z","snapshot_observed_at":"2026-08-09T07:43:31.481405Z","submitted_at":"2026-06-08T06:25:54Z","title":"FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention","version":3},"cited_work":{"arxiv_id":"2606.09079","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09079","snapshot_observed_at":"2026-08-12T00:32:38.243091Z","title":"FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention","venue":"cs.LG","work_id":"c729628e-5a41-465b-ba58-2dfdccc5aac0","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.707312Z"},"links":{"cited_paper":"/paper/2606.09079","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:ea5c0e836f9caacf8e5aa77e63c9973f1c45302f8330b554655c6a10b34c55ae","observation_id":"5b25bf9d-d2b2-443f-a215-5b1f0bcb48f7","resolution":{"observed_at":"2026-08-12T00:32:38.249021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-12T00:32:37.720042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.720042Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:71491dc6e4e5c9e862b540250b9b9f8ed4da523d74bc4746a126aaea172c5eb7","observation_id":"a7f522f9-59a4-488e-9dd9-1c179cdfe35f","resolution":{"observed_at":"2026-08-12T00:32:37.720042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.715845Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.715845Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:9a5a22b2e259ae150efe2666c8a9e369dd7bfbee6e4bba78c4efef757d7affb9","observation_id":"9424f8df-2c5d-4652-9a75-be74b4a95630","resolution":{"observed_at":"2026-08-12T00:32:37.715845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.729048Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.729048Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:30ab4fe250f2e21615eb3abb48d4ab44c2d8f5d4005aae26b72ec8214a79d444","observation_id":"821ccd77-a208-41b5-8e0d-a3dea65effac","resolution":{"observed_at":"2026-08-12T00:32:37.729048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-13T02:44:49.555221Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-12T00:32:37.724381Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.724381Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:e07c076eb785611d03faae84d4fe9939053cda1a9114d484e03c265132a69bdd","observation_id":"fda8b57d-e692-49fc-bc62-15f0d07d7de8","resolution":{"observed_at":"2026-08-12T00:32:37.724381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.14510","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.994037Z","title":null,"venue":null,"work_id":"2b078321-fb70-430a-8eab-9d3d74b30a60","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.744673Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:0791d6862f77b341450685b717a1a31f7de9a57f53faced3e886d9932ded0f6a","observation_id":"a5edb732-acd9-4849-a066-44e9b495d50b","resolution":{"observed_at":"2026-08-12T00:32:38.001102Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.830123Z","title":"Can Xiao, Sukmin Cho, Junbong We, Zhixiong Niu, Jianyi Cheng, Yiren Zhao, Youngjin Kwon, Yongqiang Xiong, Rui Ma, and Junyi Liu","venue":null,"work_id":"2f9c37ef-6561-4094-9fb4-2e254fe5a72a","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.733811Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:1679165ec52499efd5e47b0174e793dc6a02dc41e65a2a997404b4a2939eab35","observation_id":"398d303e-d41c-4071-8155-f5b2a672ed24","resolution":{"observed_at":"2026-08-12T00:32:38.834752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36592","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.892324Z","title":null,"venue":null,"work_id":"01f77632-a925-4bb2-8f27-c1647857c435","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.754805Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:2881ebc498c448637c7da6a4884a8fddc4a707fa2d1442477c960559203c995b","observation_id":"ea420bec-81ba-4fef-8e2f-2b0d3f8aaf0c","resolution":{"observed_at":"2026-08-12T00:32:37.900572Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26837","last_updated":"2026-04-29T16:02:00Z","snapshot_observed_at":"2026-08-11T10:04:20.893138Z","submitted_at":"2026-04-29T16:02:00Z","title":"Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26837","snapshot_observed_at":"2026-08-12T00:32:37.759572Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.759572Z"},"links":{"cited_paper":"/paper/2604.26837","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5fd00840ee87930b30994aa9d730a3cfcc85f8b5be0214fc9dc7a530f79075d5","observation_id":"c59c5c3a-4062-4d2f-900e-fd9265d8d609","resolution":{"observed_at":"2026-08-12T00:32:37.759572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-12T00:32:37.749739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.749739Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:046bed205f81e6284f9dac0857e792eb8994fae32b3fa65adb8c1a93924186be","observation_id":"83ef0856-0ebf-466a-9b1d-29f6f273156f","resolution":{"observed_at":"2026-08-12T00:32:37.749739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.769236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.769236Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:62056cf89313c35817cfcc9709220de38aeb88af75c4d8aa350c6e154dbd3f2a","observation_id":"214eeae0-b4f1-48b2-b965-3bdfb1f762c2","resolution":{"observed_at":"2026-08-12T00:32:37.769236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.799991Z","title":"2026.HiSparse: Turbocharging Sparse Attention with Hierarchical Memory","venue":null,"work_id":"d9bd1f51-580a-421f-a1ec-08bfa567a6e5","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.764484Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:7d090d5e76a1ed199484dddb27720b4666d49e711706498dbb0e32cb234ff4aa","observation_id":"ea346f1f-94eb-4812-a2b2-f75700aec759","resolution":{"observed_at":"2026-08-12T00:32:38.804338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.814719Z","title":"InAdvances in Neural Information Processing Systems, Vol","venue":null,"work_id":"1fb7586d-ed5d-4eae-bc87-a24356479cb5","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.739218Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:880cd1dad7eecbb3e8511c19f6e784bad171e795e54c36b30632f075d24719e1","observation_id":"fed2ad1a-cd36-457a-af62-634b0ac2cb8b","resolution":{"observed_at":"2026-08-12T00:32:38.819315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04511","last_updated":"2026-06-03T06:42:05Z","snapshot_observed_at":"2026-07-06T23:44:37.797802Z","submitted_at":"2026-06-03T06:42:05Z","title":"SparDA: Sparse Decoupled Attention for Efficient Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":"2606.04511","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.04511","snapshot_observed_at":"2026-08-12T00:32:38.634413Z","title":"SparDA: Sparse Decoupled Attention for Efficient Long-Context LLM Inference","venue":"cs.CL","work_id":"0a065daa-4151-4656-b867-965493d5e598","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.583190Z"},"links":{"cited_paper":"/paper/2606.04511","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:9ec2c0ab8779453dfda7e1130e84ec5d6feb9baaf119255798a2bdffad25f21d","observation_id":"1f666ac2-23c8-493e-95a0-a9848418dffe","resolution":{"observed_at":"2026-08-12T00:32:38.640375Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-13T07:12:42.753072Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":36,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.08097."}