{"as_of":"2026-08-08T17:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dcebc693b91ffeff9ef2b6ea4a0c52265a71c3acfc01b7530face12049f11a3f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:39:40.700629Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T11:39:46.505898Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T08:20:01.011625Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2312.07104"},"observation_digest":"sha256:75ddfe415272bf07457ac497aae901c4cf98b9f1b9c175771959fc45d9f744af","observation_id":"8dc0df40-83bd-4002-b1a2-e7021f3f8de3","resolution":{"observed_at":"2026-05-12T08:20:01.176768Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:c30a4e4faa3a564ab0e9c82c0515de5a652e4349416bc28edd30655f2aa67f7e","observation_id":"f7378c09-19ef-4bdd-99d8-7d21e8faacae","resolution":{"observed_at":"2026-05-12T04:42:23.616982Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2412.03594","last_updated":"2026-04-22T15:33:51Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-11-29T05:57:37Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T16:57:46.645061Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2412.03594"},"observation_digest":"sha256:9b986d9ab9590974372022b282ba39dda508a2c2943622253f9fc836beca321f","observation_id":"29ad9e26-4fd4-4c5b-bb39-9adf2a7d1edd","resolution":{"observed_at":"2026-05-23T16:58:11.956282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-08T11:39:40.700629Z","title":"Y., R \\'e , C., and Mirhoseini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07776","last_updated":"2025-07-13T04:42:28Z","snapshot_observed_at":"2026-08-08T11:33:05.794452Z","submitted_at":"2025-02-11T18:58:04Z","title":"Auditing Prompt Caching in Language Model APIs","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T11:39:40.700629Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2502.07776"},"observation_digest":"sha256:92643c494de8e3a51d1e97a4d8bd722a7791255ef69413b5a26a8d92e4a9ae46","observation_id":"d023f8a6-482b-4e87-afbf-0cc32b1bcc64","resolution":{"observed_at":"2026-08-08T11:39:40.700629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-07T10:30:34.260984Z","title":"Hydragen: High-throughput llm inference with shared prefixes.arXiv preprint arXiv:2402.05099,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.260984Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:9e3e88dbb6689e3a5f32255228262bca62e501c1eed7a6426dc09de4d2ba9e20","observation_id":"4b210226-1ba2-46f0-94b8-7912b1eae50a","resolution":{"observed_at":"2026-08-07T10:30:34.260984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-06T23:00:11.093224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20187","last_updated":"2025-07-02T05:12:29Z","snapshot_observed_at":"2026-08-07T20:42:38.846597Z","submitted_at":"2025-06-25T07:26:42Z","title":"Breaking the Boundaries of Long-Context LLM Inference: Adaptive KV Management on a Single Commodity GPU","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:00:11.093224Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2506.20187"},"observation_digest":"sha256:d839b80a7944e9a6a28009df18cc74f1c47c7dd1719c2b3bafaa2d5c2b0de8e8","observation_id":"6acb8aa0-8d0e-42d9-9f0f-43b53db11b11","resolution":{"observed_at":"2026-08-06T23:00:11.093224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-06T13:57:15.723671Z","title":"Hydragen: High-throughput llm inference with shared prefixes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19906","last_updated":"2025-08-04T08:19:26Z","snapshot_observed_at":"2026-08-08T09:20:56.167689Z","submitted_at":"2025-07-26T10:34:53Z","title":"CaliDrop: KV Cache Compression with Calibration","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:57:15.723671Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2507.19906"},"observation_digest":"sha256:567848eb6285f650b30f21e58d4f736599e568970b222ddf2cbe109c9c29dcba","observation_id":"f92c6351-36f5-467d-8658-d8e1baa35229","resolution":{"observed_at":"2026-08-06T13:57:15.723671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-05T21:38:53.050106Z","title":"Hydragen: High-throughput llm inference with shared prefixes.arXiv preprint arXiv:2402.05099,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.08192","last_updated":"2025-08-11T17:11:26Z","snapshot_observed_at":"2026-08-08T01:17:25.728418Z","submitted_at":"2025-08-11T17:11:26Z","title":"Efficient Speculative Decoding for Llama at Scale: Challenges and Solutions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:38:53.050106Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2508.08192"},"observation_digest":"sha256:3c75a9002e7519a087dd85054ad3389d2bbfcb0f37736e5658ff6294c2b2ba3b","observation_id":"d4bd292e-1473-4a07-954c-7d0590f9378e","resolution":{"observed_at":"2026-08-05T21:38:53.050106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2603.10726","last_updated":"2026-05-20T10:27:28Z","snapshot_observed_at":"2026-07-06T22:48:39.649787Z","submitted_at":"2026-03-11T12:59:12Z","title":"PrefixWall: Mitigating Prefix Caching Side Channels in Shared LLM Systems","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T12:14:09.509302Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2603.10726"},"observation_digest":"sha256:fb5cb6c9b8e2ab3c52e25788d139d827da71253d407e30b0e7b71192ce56f795","observation_id":"b29408a1-2498-4e35-9655-7eebfbf5dd8d","resolution":{"observed_at":"2026-05-21T12:15:06.784846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2604.23477","last_updated":"2026-05-14T05:59:30Z","snapshot_observed_at":"2026-07-06T23:09:43.659053Z","submitted_at":"2026-04-26T00:05:53Z","title":"SEMA-SQL: Beyond Traditional Relational Querying with Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T05:11:46.991452Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2604.23477"},"observation_digest":"sha256:776165ee8b21be37cef8a74b5c726ecdd19df3e8912d1faa747fcdaf62675e34","observation_id":"871fe2b3-6d42-4b7d-9d84-4e326f4e8d49","resolution":{"observed_at":"2026-05-11T21:31:17.460759Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2604.23477","last_updated":"2026-05-14T05:59:30Z","snapshot_observed_at":"2026-07-06T23:09:43.659053Z","submitted_at":"2026-04-26T00:05:53Z","title":"SEMA-SQL: Beyond Traditional Relational Querying with Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T06:53:11.604043Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2604.23477"},"observation_digest":"sha256:b6d82986a296811ab544aff33b67297b608b97fa5ba2ea74ed30e42f1cffbb23","observation_id":"215da78f-f1e6-4f31-bf4d-dd1394a001fc","resolution":{"observed_at":"2026-05-15T06:55:10.559212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2605.02960","last_updated":"2026-05-15T03:29:35Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-05-03T03:10:24Z","title":"MoE-Prefill: Zero Redundancy Overheads in MoE Prefill Serving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T19:29:28.916831Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2605.02960"},"observation_digest":"sha256:8c784a8dfb5e1111768444a7500628be65974063630567d6bc68c1907478053e","observation_id":"cdedbf31-6a5a-4d3f-bd19-7c5b09b0f9e7","resolution":{"observed_at":"2026-05-09T05:50:27.025286Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2605.02960","last_updated":"2026-05-15T03:29:35Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-05-03T03:10:24Z","title":"MoE-Prefill: Zero Redundancy Overheads in MoE Prefill Serving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T17:43:56.767714Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2605.02960"},"observation_digest":"sha256:f242a5274e0a377c3b07742cbe24551ffc0b3a6caa45eb9963d6dcba68c7c4ff","observation_id":"bf46b8a7-09f8-4d97-b749-180b2cc8fe59","resolution":{"observed_at":"2026-05-19T17:47:41.948204Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2606.17059","last_updated":"2026-05-07T15:40:51Z","snapshot_observed_at":"2026-08-07T15:57:03.163515Z","submitted_at":"2026-05-07T15:40:51Z","title":"Towards Distributed Inference of LLMs on a P2P Network","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-30T23:13:57.705287Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2606.17059"},"observation_digest":"sha256:479af491cbffade79c1eb0dc6b6726ab23a3574ac4bc36d3d4147b660c5b178d","observation_id":"f1d616d3-9ae6-4017-9f98-73d82614dd82","resolution":{"observed_at":"2026-06-30T23:15:07.948549Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2606.20537","last_updated":"2026-06-18T17:49:36Z","snapshot_observed_at":"2026-07-06T23:55:38.979306Z","submitted_at":"2026-06-18T17:49:36Z","title":"Execution-State Capsules: Graph-Bound Execution-State Checkpoint and Restore for Low-Latency, Small-Batch, On-Device Physical-AI Serving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T17:39:47.477338Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2606.20537"},"observation_digest":"sha256:36e4032120c516736734158c8fb566a0847f680c123af570b9866934a7e3f98f","observation_id":"2da98e4e-03c3-407d-82ff-7497334a5223","resolution":{"observed_at":"2026-07-04T03:49:29.915609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2606.23791","last_updated":"2026-06-29T13:00:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-22T18:00:02Z","title":"One Generator, Any Process: LLM-Conditioning for the LHC","version":1},"reference_index":276,"source":"arxiv_source","source_observed_at":"2026-06-26T07:53:57.250401Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2606.23791"},"observation_digest":"sha256:7634896d217380740e0cc76beeb56b334a58ac1473fd4a6acb1143a493f53b73","observation_id":"1f20be0c-1054-4a50-b7b3-0d28561a3184","resolution":{"observed_at":"2026-07-04T11:39:46.507262Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2606.23791","last_updated":"2026-06-29T13:00:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-22T18:00:02Z","title":"One Generator, Any Process: LLM-Conditioning for the LHC","version":2},"reference_index":280,"source":"arxiv_source","source_observed_at":"2026-06-30T10:13:09.503522Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2606.23791"},"observation_digest":"sha256:fa1715bfe4f55dc69916605dcf204372926c9d5ec00c587939fd5d6ea7b69f61","observation_id":"1157fc1f-5e5f-40d0-85bc-7aee4a5b97ca","resolution":{"observed_at":"2026-06-30T10:14:36.110959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-12T09:50:23.266920Z","title":"Y., Ré, C., and Mirhoseini, A.Hydragen: High-throughput llm inference with shared prefixes.arXiv preprint arXiv:2402.05099(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02574","last_updated":"2026-06-30T16:12:40Z","snapshot_observed_at":"2026-07-12T09:50:22.497230Z","submitted_at":"2026-06-30T16:12:40Z","title":"From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-12T09:50:23.266920Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2607.02574"},"observation_digest":"sha256:83feee948b8b910be1f1dab62b5b17492d079792d7012d57c4efd0ecc2f4c144","observation_id":"ec8e962e-f30c-442b-9bf0-228e2aebb6a8","resolution":{"observed_at":"2026-07-12T09:50:23.266920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.05099/citation-record","integrity":"/paper/2402.05099/integrity","json":"/paper/2402.05099/citation-record.json","paper":"/paper/2402.05099"},"outbound":[],"paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 18 inbound Pith citation observations for arXiv:2402.05099."}