{"as_of":"2026-08-19T22:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6de8360c7ce832a1a84bad9dc4993bbfd32a9f4c3d02d713a706b061ca8a108","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T11:28:46.149597Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27090/citation-record","integrity":"/paper/2607.27090/integrity","json":"/paper/2607.27090/citation-record.json","paper":"/paper/2607.27090"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.044382Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.044382Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:acd41d48d33665f58fdc86299457fa617b46fd9a0b6da16aa35399928f1cc635","observation_id":"37566546-d866-4eaa-a383-222fecc90280","resolution":{"observed_at":"2026-07-30T11:28:46.044382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.049019Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.049019Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:2cd2a22e33dcc505f93909df7cfc9b78b2927da7fe248adcebdf976c22031f4b","observation_id":"a1d8b654-3401-4eae-8e43-e7b03f4fa9cd","resolution":{"observed_at":"2026-07-30T11:28:46.049019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.056911Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.056911Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:c73de7d3e1aa92f0273e4faa283b89566e84bd28cad46d2713dc4485386bc22c","observation_id":"be90ae9f-7f8e-4dab-a72b-00b3f4696b21","resolution":{"observed_at":"2026-07-30T11:28:46.056911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-07-30T11:28:46.076698Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.076698Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:7370919e8ca4c53fe647caae8977c48fe644da8070cbe0bd483124a01b713354","observation_id":"04e99a97-efb6-4dd7-ad91-ba3054009455","resolution":{"observed_at":"2026-07-30T11:28:46.076698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.081534Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.081534Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:85b5d22fe95628d9b9d8e74af2ff735450e73288a8439ff06e9992bbb4b661d7","observation_id":"7c4afc26-d307-4781-acbc-1d5346698589","resolution":{"observed_at":"2026-07-30T11:28:46.081534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.084877Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.084877Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:2f0c05e73061ffd70f2b726ac3456566a29f6a9a5838043b4a997d45001bc236","observation_id":"9f78ea3f-b1ed-4316-bf73-5a9454e9c926","resolution":{"observed_at":"2026-07-30T11:28:46.084877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.087747Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.087747Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:b2b91842df8c634f35131f734529ffddd4fb9d2c84e5f14f9e180c5d8983bba5","observation_id":"2d2fff50-1e56-4a99-97c4-5b1222963c24","resolution":{"observed_at":"2026-07-30T11:28:46.087747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.091040Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.091040Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:9b4806061446acd28169a2172a30c590b1cf94bdef13be4e93fad214389565d1","observation_id":"0d4b33e9-3654-4a87-8623-b0ae5cc9fb0b","resolution":{"observed_at":"2026-07-30T11:28:46.091040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.094654Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.094654Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:bb485f3c918c7ddc513a466e65ef9bc981afafb927bf618112b91ca2892a21de","observation_id":"bf9737a3-3410-40c7-ab33-7d34a9763a4e","resolution":{"observed_at":"2026-07-30T11:28:46.094654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.097704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.097704Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:552827bd4180d08cfee0401dc887acdb15a943f43501467baf53b192d2a5dfc7","observation_id":"304756e9-d774-4d17-859a-c3f0543e3e6f","resolution":{"observed_at":"2026-07-30T11:28:46.097704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.102234Z","title":"Malkov and Dmitry A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.102234Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:609a5c3238583b80a35cf5a560e050fa67e56c72aa61f7b67388a73594962496","observation_id":"a1a90044-910b-4e6c-bd07-ec33262c1d41","resolution":{"observed_at":"2026-07-30T11:28:46.102234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07048","last_updated":"2026-07-31T03:12:32Z","snapshot_observed_at":"2026-08-10T14:40:56.643466Z","submitted_at":"2026-01-11T19:51:54Z","title":"GPU-Accelerated ANNS: Quantized for Speed, Built for Change","version":5},"cited_work":{"arxiv_id":"2601.07048","doi":"10.48550/arxiv.2601.07048","metadata_source":"pith","pith_arxiv_id":"2601.07048","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"GPU-Accelerated ANNS: Quantized for Speed, Built for Change","venue":"cs.DB","work_id":"8c368b0d-05e8-496c-af73-c7dfc4a09c2b","year":2026},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.105604Z"},"links":{"cited_paper":"/paper/2601.07048","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:9bfeee9e3a6de59133f8ba5660e45b75279e71ab2c40e546e5869af6b0624ef1","observation_id":"e7d62fe4-bbed-4e64-938b-ec7bc9e1263e","resolution":{"observed_at":"2026-07-30T11:31:24.511279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.109345Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.109345Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:772b478ec1e51676c14c70f5390bfef09e7c2c9f08ed3ce8752e16a759b34e18","observation_id":"e967ecdf-9fa9-46e8-b711-ff7d5fb96c42","resolution":{"observed_at":"2026-07-30T11:28:46.109345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15136","last_updated":"2024-07-09T02:41:11Z","snapshot_observed_at":"2026-08-18T18:55:55.229074Z","submitted_at":"2023-08-29T09:10:53Z","title":"CAGRA: Highly Parallel Graph Construction and Approximate Nearest Neighbor Search for GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15136","snapshot_observed_at":"2026-07-30T11:28:46.113083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.113083Z"},"links":{"cited_paper":"/paper/2308.15136","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:a99c3a40f26327ad69d06c30cf9ec6b7c464a21eeab4f6c9aa5abc730d6f1779","observation_id":"e7141fbd-f659-4161-91d1-32f7be519e57","resolution":{"observed_at":"2026-07-30T11:28:46.113083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.116456Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.116456Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:cb1bb3272d73a3830a215146967f3f1c61d25d14b21cd3e048977d8ed174cbc9","observation_id":"cbf462f1-58d7-44c1-bd25-d98b91c05fff","resolution":{"observed_at":"2026-07-30T11:28:46.116456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-19T03:45:55.054912Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-07-30T11:28:46.119550Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.119550Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:431b23563275649083e677525ce25e4c8322794fd449614b4abab8359c56dc90","observation_id":"a558af79-5dd6-407b-b3ac-7010419ad78e","resolution":{"observed_at":"2026-07-30T11:28:46.119550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.123496Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.123496Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:7ce20d33de69be87d3f94397ad93dfb84ca730ddd5db4b074df77ec774b192bd","observation_id":"07f65075-c968-4409-b663-f11cd8fa64ab","resolution":{"observed_at":"2026-07-30T11:28:46.123496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-30T11:28:46.126170Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.126170Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:1fc535bd803534586c04e7106e861fe09905b3293c97a9993f1f27f832adc7d4","observation_id":"8c5f2230-5d9d-4091-9531-74acfb5a8423","resolution":{"observed_at":"2026-07-30T11:28:46.126170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13956","last_updated":"2025-01-20T16:52:48Z","snapshot_observed_at":"2026-08-16T13:40:23.316949Z","submitted_at":"2025-01-20T16:52:48Z","title":"Zep: A Temporal Knowledge Graph Architecture for Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13956","snapshot_observed_at":"2026-07-30T11:28:46.130217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.130217Z"},"links":{"cited_paper":"/paper/2501.13956","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:1b3e2eda4ad92c65bcb49a735200c77139ac5ea8c0a59e84bdd75c2875661ba0","observation_id":"2aeed1b5-f522-4389-bf7e-bed635d2fca2","resolution":{"observed_at":"2026-07-30T11:28:46.130217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.134413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.134413Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:3068b5c57c0e1902515aacd02fdf237b96339903a34501cd50d128d10d14f174","observation_id":"7df1da0f-6245-47a1-9aea-aba577a68100","resolution":{"observed_at":"2026-07-30T11:28:46.134413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-30T11:28:46.137141Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.137141Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:4773f4e44e01775d60e169d084ce26b5cb20024adc41aa520fb87a22ea98f2e0","observation_id":"c3a70605-7e2b-458c-8691-7c275a8f0ad7","resolution":{"observed_at":"2026-07-30T11:28:46.137141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-30T11:28:46.141728Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.141728Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:1bad636b8da1dc954f1ed81ac92ab062bf93b39b503d2c7e6a63322fdb191b19","observation_id":"a2d09d7e-73bf-4e93-930e-ebccd45b4895","resolution":{"observed_at":"2026-07-30T11:28:46.141728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04302","last_updated":"2026-06-03T00:12:22Z","snapshot_observed_at":"2026-08-12T17:17:53.871767Z","submitted_at":"2026-06-03T00:12:22Z","title":"LazyAttention: Efficient Retrieval-Augmented Generation with Deferred Positional Encoding","version":1},"cited_work":{"arxiv_id":"2606.04302","doi":"10.48550/arxiv.2606.04302","metadata_source":"pith","pith_arxiv_id":"2606.04302","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"LazyAttention: Efficient Retrieval-Augmented Generation with Deferred Positional Encoding","venue":"cs.CL","work_id":"c5055f7f-87da-4ef3-9ce3-caa9cd6aa0d9","year":2026},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.145401Z"},"links":{"cited_paper":"/paper/2606.04302","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:c584310a0e57fc0c0ccfd13c48760e69e5dcc7f7e2dbb0fb632c3dec247b1419","observation_id":"395608e1-680f-4a25-977e-75765c5feaba","resolution":{"observed_at":"2026-07-30T11:31:24.263335Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T11:28:46.149597Z","title":"Identical","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.149597Z"},"links":{"citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:7965c83e153f166c5a0733c44f63d23112e09abdb5c2fbf1babaa29930c8bce7","observation_id":"a08e161b-f0a1-4f9d-a2e8-b811d0b9250f","resolution":{"observed_at":"2026-07-30T11:28:46.149597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-07-30T11:28:46.063347Z","title":"arXiv:2504.19413 doi:10.48550/arXiv.2504.19413","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-30T11:28:46.063347Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2607.27090"},"observation_digest":"sha256:a14cf0513cc980279a69db9145897b394cde67d7567fc6d08c336c84e5a2ddbe","observation_id":"3d7d3dc9-f830-48ae-86fa-ab6e91a0cce9","resolution":{"observed_at":"2026-07-30T11:28:46.063347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27090","last_updated":"2026-07-29T16:18:22Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-19T20:56:58.955400Z","submitted_at":"2026-07-29T16:18:22Z","title":"InferScale: GPU-Native KV Injection for Personalized LLM Serving"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.27090."}