{"as_of":"2026-08-10T15:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:338605b0275de929ef782a1e27c3120747e39f7eb640c0be77f033a062acabc1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:03:52.902518Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:57:38.712067Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-08-06T19:03:52.902518Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06608","last_updated":"2025-08-07T12:26:15Z","snapshot_observed_at":"2026-08-06T18:56:52.854557Z","submitted_at":"2025-07-09T07:27:18Z","title":"Nexus:Proactive Intra-GPU Disaggregation of Prefill and Decode in LLM Serving","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:52.902518Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2507.06608"},"observation_digest":"sha256:fbf216f3acdb2d44a49e106b8e79fadee4103354f12b64d384ed62016da69175","observation_id":"fd7d91d0-44e7-4401-95ab-fb53c88276eb","resolution":{"observed_at":"2026-08-06T19:03:52.902518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-08-03T23:39:06.362657Z","title":"semi-pd: Towards efficient llm serving via phase-wise disaggre- gated computation and unified storage.arXiv preprint arXiv:2504.19867,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.04791","last_updated":"2026-05-30T23:27:43Z","snapshot_observed_at":"2026-08-10T13:50:51.313192Z","submitted_at":"2025-11-06T20:18:34Z","title":"DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T23:39:06.362657Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2511.04791"},"observation_digest":"sha256:038e168fa9ea63c84305487678f379227fa2e01d30846049d00dcc09dbd75af0","observation_id":"633d21dc-2e09-4afa-a53e-f7dfe3ee0580","resolution":{"observed_at":"2026-08-03T23:39:06.362657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-08-07T20:25:38.013655Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:65e81c3f73373d2e00f27fd96620ea8b69d0e018e2810a1b3f60da94d7855d67","observation_id":"e2ba28d7-9b2c-4bf3-9bb3-e753026a5fc8","resolution":{"observed_at":"2026-05-11T20:16:10.262035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2605.13734","last_updated":"2026-05-13T16:12:33Z","snapshot_observed_at":"2026-08-09T15:04:19.889122Z","submitted_at":"2026-05-13T16:12:33Z","title":"KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T17:42:06.870534Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2605.13734"},"observation_digest":"sha256:65a6503d0de67e70fe0ab83882818bb500c1dd6a3598c7426bfacdcd7add951c","observation_id":"e3cf6b4c-9744-43e2-b0f6-bc0407270db5","resolution":{"observed_at":"2026-05-14T17:42:31.180388Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:7c091fe4781f1f7deecfe1104b83f0d186f115acf01086af6103695fbd9521c3","observation_id":"249612ad-faab-49d3-b2e2-9277affae70a","resolution":{"observed_at":"2026-07-02T10:46:52.308744Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2606.10537","last_updated":"2026-06-09T08:06:22Z","snapshot_observed_at":"2026-08-06T08:45:04.024766Z","submitted_at":"2026-06-09T08:06:22Z","title":"Prefilling-dLLM: Predictive Prefilling for Long-Context Inference in Diffusion Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T13:30:19.620692Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2606.10537"},"observation_digest":"sha256:fa9d52ee6ffbd0aa874e2807b37cfc84f2f46fa0f5b06f17921740e46c30db34","observation_id":"478a67f2-2dab-4a49-9434-6844a04c21d7","resolution":{"observed_at":"2026-07-03T04:57:38.713663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.19867/citation-record","integrity":"/paper/2504.19867/integrity","json":"/paper/2504.19867/citation-record.json","paper":"/paper/2504.19867"},"outbound":[],"paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2504.19867."}