{"as_of":"2026-08-19T09:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37ce9b543bad75bb738734f277538aa8b4ebd527bef7d5913f7311bab2f2c9d2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:49:09.923494Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.031071Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":"2406.19707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-07-10T01:36:44.031071Z","title":"Xin Li and Dan Roth","venue":"cs.LG","work_id":"57b180a0-b105-4bd0-a104-5e90e82b0121","year":2024},"citing_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T09:58:29.057357Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2406.02069"},"observation_digest":"sha256:9dbc0ebdddbef2d032cea501a659daf08d439844d5a956e908b0d30b098bf0fd","observation_id":"dccc4d18-53e0-470f-8c6e-8d12fae31190","resolution":{"observed_at":"2026-05-12T09:58:29.177917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-12T11:17:01.056873Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18424","last_updated":"2024-11-27T15:07:28Z","snapshot_observed_at":"2026-08-15T12:51:39.132785Z","submitted_at":"2024-11-27T15:07:28Z","title":"FastSwitch: Optimizing Context Switching Efficiency in Fairness-aware Large Language Model Serving","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T11:17:01.056873Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2411.18424"},"observation_digest":"sha256:3f1779869bc4521c7c04864b630cabd8ffc1843ff133d0bb7346a920df03264e","observation_id":"3ff725c1-b319-46c4-98d4-42e2ac89501f","resolution":{"observed_at":"2026-08-12T11:17:01.056873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-11T00:38:48.282112Z","title":"Infinigen: Efficient generative inference of large language models with dynamic kv cache management,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-15T13:24:51.697670Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:48.282112Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:e6014f44d241574b02ffacbf653fddc679fcd7034498b3d0be7e430f7a0cea27","observation_id":"b8a528e6-cb3e-49af-98b8-f92b9800bef4","resolution":{"observed_at":"2026-08-11T00:38:48.282112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-08T14:13:38.139717Z","title":"Infinigen: Efficient generative inference of large language models with dynamic kv cache management, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06975","last_updated":"2025-02-10T19:14:51Z","snapshot_observed_at":"2026-08-14T08:32:12.525435Z","submitted_at":"2025-02-10T19:14:51Z","title":"Position: Episodic Memory is the Missing Piece for Long-Term LLM Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T14:13:38.139717Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2502.06975"},"observation_digest":"sha256:4028f98c87424b0c67f1ecb75edcd5efe7dc1095dadb8adf825cce542f0cd5f8","observation_id":"338fa06c-f151-4c7f-9d4a-a3e55bb3aa4e","resolution":{"observed_at":"2026-08-08T14:13:38.139717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-16T05:49:09.923494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19720","last_updated":"2025-04-28T12:14:02Z","snapshot_observed_at":"2026-08-19T00:58:17.913230Z","submitted_at":"2025-04-28T12:14:02Z","title":"Taming the Titans: A Survey of Efficient LLM Inference Serving","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T05:49:09.923494Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2504.19720"},"observation_digest":"sha256:c049adde31f4eae42ce469a0152f6ac13605a3ea2a46e67ab6f6db4fcbd54887","observation_id":"10071de2-32f5-475a-a6a4-d2e21d55de2f","resolution":{"observed_at":"2026-08-16T05:49:09.923494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-03T01:18:03.682651Z","title":"Infinigen: Efficient generative inference of large language models with dynamic kv cache management.ArXiv preprint, abs/2406.19707, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10238","last_updated":"2026-06-26T10:01:58Z","snapshot_observed_at":"2026-08-18T06:08:24.733472Z","submitted_at":"2026-02-10T19:34:15Z","title":"Learning to Evict from Key-Value Cache","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T01:18:03.682651Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2602.10238"},"observation_digest":"sha256:3681e1762737137d2dc13e6270f1150ba91244ce5b0ec96e5b01b496580690b8","observation_id":"ecc0368c-8fbc-4f5b-b3a2-538d423db716","resolution":{"observed_at":"2026-08-03T01:18:03.682651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":"2406.19707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-07-10T01:36:44.031071Z","title":"Xin Li and Dan Roth","venue":"cs.LG","work_id":"57b180a0-b105-4bd0-a104-5e90e82b0121","year":2024},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-18T23:35:57.173534Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:2d200f47d4abff77f92c8f996722ac5561b083462c6288ff771f2e919793d8c1","observation_id":"25aa3296-4961-4fb7-afed-6a6942e02e3c","resolution":{"observed_at":"2026-07-10T01:36:44.032589Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-12T00:32:37.618708Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-18T04:59:06.437774Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.618708Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:de286c12558a268e6d2382e61dc81d89f4c0724f940c26f890ee4bfd2b0abb7e","observation_id":"fde42d2b-c679-4b89-b9d4-d136330f7f74","resolution":{"observed_at":"2026-08-12T00:32:37.618708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.19707/citation-record","integrity":"/paper/2406.19707/integrity","json":"/paper/2406.19707/citation-record.json","paper":"/paper/2406.19707"},"outbound":[],"paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T11:19:55.925030Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2406.19707."}