{"as_of":"2026-08-20T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ff42cb561742a5f51c44f2b5ca8991de6a06ce123c5789c5fc505fa3ff9c655","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:51:19.492509Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.20274/citation-record","integrity":"/paper/2508.20274/integrity","json":"/paper/2508.20274/citation-record.json","paper":"/paper/2508.20274"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.943637Z","title":"Franklin, Joseph E","venue":null,"work_id":"86bf5ed7-a2ee-4993-80b8-ae99a96ad4c0","year":2017},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.437497Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:604d700b1ef8e7047e6144edbf46eac156571ef6e81e9c269aeafbaf49714bce","observation_id":"f01a6b4d-901a-4f70-b0b1-367d734981d8","resolution":{"observed_at":"2026-08-15T16:51:19.948785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.928607Z","title":null,"venue":null,"work_id":"1eb5da26-347a-4760-9357-21da6f215bab","year":2019},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.442893Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:333a1127081bd9047474fba3b0c540f395fad12b0775c14ba10c6c6c5f2f9fb8","observation_id":"0b9999b7-e16f-4046-a46e-11448d26f152","resolution":{"observed_at":"2026-08-15T16:51:19.933366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.448678Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.448678Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:2b2a9d215983bd69fb71c8e9c90ded136bbfef7e19aecc04725dbfbcfe83250f","observation_id":"e5d92bfe-9714-4dc9-b271-9fe00251ad1c","resolution":{"observed_at":"2026-08-15T16:51:19.448678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.29551","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.765403Z","title":null,"venue":null,"work_id":"63f46fef-f15e-48ba-9cc9-d195d3ae277e","year":2019},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.459377Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:1af4f161ccc5070a126a0849ec74810b45da3ee3f772d0102af3c2c673f3f117","observation_id":"045c41ff-21b8-4a88-9fad-96a2f1243555","resolution":{"observed_at":"2026-08-15T16:51:19.772869Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.902224Z","title":null,"venue":null,"work_id":"08e4b7a0-3670-428c-a826-651a5646ef8a","year":2020},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.464483Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:aaa52ec97941cd0c68a81f4a4dbd5c279c02809127185f144e0ad0f7d77d941a","observation_id":"cd678bae-0017-4438-9667-a957009f6033","resolution":{"observed_at":"2026-08-15T16:51:19.907189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.469218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.469218Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:64d4143171fb174ee75ae589148e96c60a54ca865e8c6234de769b074b739fc0","observation_id":"6c54928a-1f1d-413b-add3-916ce4a4fb02","resolution":{"observed_at":"2026-08-15T16:51:19.469218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2031.37123","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.625665Z","title":null,"venue":null,"work_id":"5cecdadb-a953-49d2-9e05-e1cb27dafd0f","year":2025},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.473804Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:9ef36c77cb1ffba09921d520b6e3bafd89b52dd1f691b32bbb130949ee932b1a","observation_id":"d9067cdc-ae31-49eb-8e8e-ad10bcd8372d","resolution":{"observed_at":"2026-08-15T16:51:19.634116Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13126","last_updated":"2024-07-18T03:32:53Z","snapshot_observed_at":"2026-08-17T09:46:39.435389Z","submitted_at":"2024-07-18T03:32:53Z","title":"Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13126","snapshot_observed_at":"2026-08-15T16:51:19.478921Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.478921Z"},"links":{"cited_paper":"/paper/2407.13126","citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:66588dfba9100a1aa762d0f194fd9645efe421ede9cf4cf6f3c1df8265a7c24b","observation_id":"caf11eec-2ae6-47d3-a04b-dbdb03b078ab","resolution":{"observed_at":"2026-08-15T16:51:19.478921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.886541Z","title":null,"venue":null,"work_id":"72310b2f-198d-48b7-9bca-b91df0f514fb","year":2023},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.483658Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:118b9a24b036b29d8132efedbb42d0c9c664c9180d7ed4e9f2417d75a946d667","observation_id":"9d479b32-88b9-4b84-8b8e-e56bb0846e13","resolution":{"observed_at":"2026-08-15T16:51:19.891302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.870763Z","title":null,"venue":null,"work_id":"96d9994f-5220-4a0f-baa2-124fb904d042","year":2018},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.487856Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:b4fed7be94d501e8b5b423f82b2554f1132a46bacded2c8c12b5b43a1c119988","observation_id":"bc89802c-0764-4b0e-87a5-2e80d2a8ef36","resolution":{"observed_at":"2026-08-15T16:51:19.875892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.854468Z","title":null,"venue":null,"work_id":"bc60c535-89e3-4bfe-9beb-ba34b20c04e9","year":2025},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.492509Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:d233cf27fca079c7b328bd4665abbdd51f71e00f6ab1e57c4a50f749c687d6c2","observation_id":"fecc1f64-6278-4098-bf79-31b7cd85d581","resolution":{"observed_at":"2026-08-15T16:51:19.859214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:51:19.453580Z","title":"In Proceedings of the 13th ACM Symposium on Cloud Computing (SoCC ’22)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T16:51:19.453580Z"},"links":{"citing_paper":"/paper/2508.20274"},"observation_digest":"sha256:1942f6355df0f4d2b6ddeabb3649422035f79aa31a5bbbcd088df2ba0eb5a287","observation_id":"fcbb3e58-cf51-490b-a2c5-869a5204ca69","resolution":{"observed_at":"2026-08-15T16:51:19.453580Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20274","last_updated":"2025-08-27T21:15:41Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-15T16:45:31.035446Z","submitted_at":"2025-08-27T21:15:41Z","title":"Predictable LLM Serving on GPU Clusters"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2508.20274."}