{"as_of":"2026-08-14T11:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdedb8294b798f11acc1f6a64837a91abe6f69f5a454a186e0b0d69c0148c2d2","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:40:51.752812Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:38:49.204953Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T16:31:10.505851Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17089","snapshot_observed_at":"2026-08-11T00:38:49.204953Z","title":"Efficient llm inference with i/o-aware partial kv cache recomputation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-11T00:33:34.388194Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":244,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:49.204953Z"},"links":{"cited_paper":"/paper/2411.17089","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:23b20b4ea44f8a51f5daf3f5c400eb0d35d6e689497c284e55adfaa219a3f54f","observation_id":"f13a4da3-a693-466f-a635-19f3ee40eb49","resolution":{"observed_at":"2026-08-11T00:38:49.204953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17089","snapshot_observed_at":"2026-08-07T12:38:37.745707Z","title":"Efficient llm inference with i/o-aware partial kv cache recomputation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15704","last_updated":"2025-05-30T02:35:59Z","snapshot_observed_at":"2026-08-11T00:38:33.517153Z","submitted_at":"2025-05-30T02:35:59Z","title":"Learn from the Past: Fast Sparse Indexing for Large Language Model Decoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:38:37.745707Z"},"links":{"cited_paper":"/paper/2411.17089","citing_paper":"/paper/2506.15704"},"observation_digest":"sha256:e6fc9ad107004abb3073f613879958d3dc2b3b2bd455216638f37f3f597c87f9","observation_id":"8dd36822-23d0-4a69-a797-88e0c5ff4a97","resolution":{"observed_at":"2026-08-07T12:38:37.745707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"cited_work":{"arxiv_id":"2411.17089","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17089","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5988bbc9-f71a-417a-a9e6-cc14ee197026","year":2024},"citing_paper":{"arxiv_id":"2605.03375","last_updated":"2026-05-05T05:33:11Z","snapshot_observed_at":"2026-08-14T04:30:49.919579Z","submitted_at":"2026-05-05T05:33:11Z","title":"Tutti: Making SSD-Backed KV Cache Practical for Long-Context LLM Serving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T16:19:33.613685Z"},"links":{"cited_paper":"/paper/2411.17089","citing_paper":"/paper/2605.03375"},"observation_digest":"sha256:2a47f7ce658a7c478f7d33ef3bf66b363f31313b080e4bc9d5d74f7821859b01","observation_id":"d9eba12a-550a-4c38-b750-529da45dadfd","resolution":{"observed_at":"2026-05-11T16:31:10.512778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.17089/citation-record","integrity":"/paper/2411.17089/integrity","json":"/paper/2411.17089/citation-record.json","paper":"/paper/2411.17089"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-13T19:01:59.954755Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-12T12:40:51.717925Z","title":"Preprint, arXiv:2403.11421","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.717925Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:96829b3cfcffa6b18a1fb6fcebef0ddd48ce48ac58b4cfcaa1ed7979e9fec0ab","observation_id":"61015e1e-527a-4049-971a-e38927b0e88f","resolution":{"observed_at":"2026-08-12T12:40:51.717925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01142","last_updated":"2024-11-02T05:15:44Z","snapshot_observed_at":"2026-08-12T22:09:19.288246Z","submitted_at":"2024-11-02T05:15:44Z","title":"NEO: Saving GPU Memory Crisis with CPU Offloading for Online LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01142","snapshot_observed_at":"2026-08-12T12:40:51.722346Z","title":"Preprint, arXiv:2411.01142","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.722346Z"},"links":{"cited_paper":"/paper/2411.01142","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:c19321d5a75e5729a7966dabc3834da8620e6b2d93c7de5af1ef8bbcfb4fa0bf","observation_id":"ba28753b-5599-4c3b-a9e7-a479bece9677","resolution":{"observed_at":"2026-08-12T12:40:51.722346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.830413Z","title":null,"venue":null,"work_id":"02e94e69-0c2c-4056-96cf-420ab4977561","year":2024},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.752812Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:edff817ad2cae98fb03931146a77e918b65cb281d1a31eb51f950478113e45ff","observation_id":"2197fee8-9bca-4351-b9e9-3a7d3ce257eb","resolution":{"observed_at":"2026-08-12T12:40:51.834636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T12:40:51.729348Z","title":"Preprint, arXiv:2303.08774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.729348Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:f984e9a176ecae0ad29216a9cd458c5aed54db11e4b9bedb72111a6279cf69ba","observation_id":"a36735cf-9553-4a9f-a276-929e4682d7c3","resolution":{"observed_at":"2026-08-12T12:40:51.729348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.870088Z","title":"In Proceedings of the 2024 International Conference on Parallel Architectures and Compila- tion Techniques, pages 233–245","venue":null,"work_id":"d153ef5a-f64a-438b-8735-c5960e448f30","year":2024},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.732486Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:72204f6b9d6608be8bc469bcb1e9baca410712416a860737f0b41ee3e98d966f","observation_id":"a5bc4129-4258-40c9-9011-9a6bd8b5d65f","resolution":{"observed_at":"2026-08-12T12:40:51.873477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T12:40:51.735584Z","title":"Preprint, arXiv:2302.13971","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.735584Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:629468b26785bd0f38609fdd0905c911095aae3290a553030f9cf1d88a49bed9","observation_id":"6e0145da-ef53-45aa-bb07-2b890420585c","resolution":{"observed_at":"2026-08-12T12:40:51.735584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.860759Z","title":"In Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing: System Demonstrations","venue":null,"work_id":"2d2a0524-7b21-4578-aa58-2f019d609eb5","year":2020},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.739789Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:80e47cfd0210dae6edc7b8b0e4f6fa6979102885fa30f7c8428ab9b9a7e44ba3","observation_id":"321d3bc7-532e-4b41-a0c7-ebaa4b1b51bf","resolution":{"observed_at":"2026-08-12T12:40:51.864328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.851640Z","title":"In Thirty-seventh Conference on Neural In- formation Processing Systems","venue":null,"work_id":"1abe926d-0faf-4495-bbf1-57b90ea32bc3","year":2024},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.746157Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:510573d5af13517ebd8624a2c55894d8ef01145e2c8e7c7046c28d2bcbf58f35","observation_id":"2f7dcad6-803d-4be6-968d-67200567f8ce","resolution":{"observed_at":"2026-08-12T12:40:51.854848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.841223Z","title":"In Findings of the Association for Computational Linguistics: NAACL 2024, pages 2765–2781","venue":null,"work_id":"b4f55ac0-ab7a-4435-95a7-0c62d320a08f","year":2024},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.749527Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:ccd0648941b0ea780caa4d1ec3cacdc4b18971581a800767383cb60d3838811c","observation_id":"d9a9397c-483b-4153-a1f6-3954de36c5a1","resolution":{"observed_at":"2026-08-12T12:40:51.845682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:40:51.879722Z","title":"In Ad- vances in Neural Information Processing Systems , volume 33, pages 1877–1901","venue":null,"work_id":"03a559c9-6419-4522-9fb0-af0d73bdfb56","year":1901},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.710750Z"},"links":{"citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:122a4f950ec662932e710e462136670d726812993e9a06ef26667f2ba8fdf3d4","observation_id":"1b7bebca-5983-431a-a6c8-dad9adfda00a","resolution":{"observed_at":"2026-08-12T12:40:51.883105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-12T12:40:51.742791Z","title":"Preprint, arXiv:2205.01068","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.742791Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:29cd0c0a04df0887ac2527313540fb1a9da5a26c396a2309816eff183abae101","observation_id":"dfdf8128-9bb0-437c-869a-c5bb40be82e8","resolution":{"observed_at":"2026-08-12T12:40:51.742791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17760","last_updated":"2023-11-02T17:34:57Z","snapshot_observed_at":"2026-08-13T20:29:29.004177Z","submitted_at":"2023-03-31T01:09:00Z","title":"CAMEL: Communicative Agents for \"Mind\" Exploration of Large Language Model Society","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17760","snapshot_observed_at":"2026-08-12T12:40:51.725849Z","title":"Preprint, arXiv:2303.17760","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.725849Z"},"links":{"cited_paper":"/paper/2303.17760","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:d4ef8cee551f2f0e73db3e6684b88b5112ab434e03d001a1ba82a37c523a6ce6","observation_id":"d80a4b07-3dc5-466e-9bb0-dfb5d39a2cee","resolution":{"observed_at":"2026-08-12T12:40:51.725849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T12:40:51.714413Z","title":"Preprint, arXiv:2312.11805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T12:40:51.714413Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.17089"},"observation_digest":"sha256:c58cf2667ca011cd6dccc22b87079809f3ef741d6c32b6d19e0267a6a0f09d99","observation_id":"d553e17d-7660-49ab-917c-2d8cf9ed06df","resolution":{"observed_at":"2026-08-12T12:40:51.714413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.17089","last_updated":"2025-06-04T16:08:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T04:32:30.737126Z","submitted_at":"2024-11-26T04:03:14Z","title":"KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 3 inbound Pith citation observations for arXiv:2411.17089."}