{"as_of":"2026-08-11T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d33ddb229d7a879a583f11509f89f1e4859c71ddec0f8bab2d18cd2ac70f12b","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:35:13.172282Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:58:36.525442Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"cited_work":{"arxiv_id":"2501.08090","doi":"10.48550/arxiv.2501.08090","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08090","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HIERARCHICAL AUTOSCALING FOR LARGE LANGUAGE MODEL SERVING WITH CHI- RON","venue":"ArXiv.org","work_id":"db4efd20-2be1-44f3-a5c4-a7f703a0255a","year":2025},"citing_paper":{"arxiv_id":"2604.16682","last_updated":"2026-04-17T20:39:25Z","snapshot_observed_at":"2026-08-11T08:29:06.896911Z","submitted_at":"2026-04-17T20:39:25Z","title":"KAIROS: Stateful, Context-Aware Power-Efficient Agentic Inference Serving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T06:58:36.525442Z"},"links":{"cited_paper":"/paper/2501.08090","citing_paper":"/paper/2604.16682"},"observation_digest":"sha256:4d282dc56e636c83aae9ed2ea159535619e61a185ac52daf849a6ad8594b2fbd","observation_id":"0854c67d-f439-43bb-9bae-802e001f6533","resolution":{"observed_at":"2026-05-10T07:01:48.829960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"cited_work":{"arxiv_id":"2501.08090","doi":"10.48550/arxiv.2501.08090","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08090","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HIERARCHICAL AUTOSCALING FOR LARGE LANGUAGE MODEL SERVING WITH CHI- RON","venue":"ArXiv.org","work_id":"db4efd20-2be1-44f3-a5c4-a7f703a0255a","year":2025},"citing_paper":{"arxiv_id":"2605.05467","last_updated":"2026-05-06T21:42:55Z","snapshot_observed_at":"2026-08-10T23:58:54.590895Z","submitted_at":"2026-05-06T21:42:55Z","title":"Nitsum: Serving Tiered LLM Requests with Adaptive Tensor Parallelism","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T15:45:54.816102Z"},"links":{"cited_paper":"/paper/2501.08090","citing_paper":"/paper/2605.05467"},"observation_digest":"sha256:64f146445768cf6934c3ee3b5df36acb0a03dc53a7ca75651e2beb8094de21db","observation_id":"fae924ce-7013-48dd-8105-37e30f77fd6b","resolution":{"observed_at":"2026-05-11T18:31:11.971214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08090/citation-record","integrity":"/paper/2501.08090/integrity","json":"/paper/2501.08090/citation-record.json","paper":"/paper/2501.08090"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.01869","last_updated":"2024-05-30T04:18:03Z","snapshot_observed_at":"2026-07-06T17:24:37.090243Z","submitted_at":"2024-02-02T19:47:57Z","title":"InferCept: Efficient Intercept Support for Augmented Large Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01869","snapshot_observed_at":"2026-08-10T20:35:13.085003Z","title":"APIServe: Efficient API support for large-language model inferencing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.085003Z"},"links":{"cited_paper":"/paper/2402.01869","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:5e001566616037a267d780f72fc9e1d17c71af52d9d6cd832cf8671a4bb7b51d","observation_id":"206c5431-b95c-4ede-8227-e8da88232496","resolution":{"observed_at":"2026-08-10T20:35:13.085003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.488532Z","title":"Serving DNNs like clockwork: Performance predictabil- ity from the bottom up","venue":null,"work_id":"821bbdc6-618e-4233-b13d-773deae9d1c0","year":2020},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.102942Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:ec7d2cc0f99ef019811509b42b12bdf4470cc7155e0a07c8c9421254076e5555","observation_id":"d5e75acf-bb5a-46a9-8707-fb3959a0be9e","resolution":{"observed_at":"2026-08-10T20:35:13.492331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.475614Z","title":"Cocktail: A multidi- mensional optimization for model serving in cloud","venue":null,"work_id":"5d7c667a-f7a8-43c1-b3e4-cbe53bf21e77","year":2022},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.107717Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:face7eaff4850ad56842df9014001cd8b1c7aa1bac6599f6d4b0068dd0079ead","observation_id":"7ccdaa54-cfcd-4b7e-9651-61be46751b82","resolution":{"observed_at":"2026-08-10T20:35:13.480608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16283","last_updated":"2024-12-13T07:01:16Z","snapshot_observed_at":"2026-08-07T14:36:50.079243Z","submitted_at":"2024-04-25T01:56:00Z","title":"Andes: Defining and Enhancing Quality-of-Experience in LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16283","snapshot_observed_at":"2026-08-10T20:35:13.116727Z","title":"Jiachen Liu, Zhiyu Wu, Jae-Won Chung, Fan Lai, Myungjin Lee, and Mosharaf Chowdhury","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.116727Z"},"links":{"cited_paper":"/paper/2404.16283","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:a6076db3270cf300144143e5e023d3a0e8b4d2226aa9bffea3af4cd5f5a8c537","observation_id":"95b21701-e3b7-400b-aa3b-8ad94a975b98","resolution":{"observed_at":"2026-08-10T20:35:13.116727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00047","last_updated":"2025-02-25T17:54:13Z","snapshot_observed_at":"2026-08-11T13:07:23.875983Z","submitted_at":"2024-06-05T21:17:34Z","title":"Queue management for slo-oriented large language model serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00047","snapshot_observed_at":"2026-08-10T20:35:13.130836Z","title":"One queue is all you need: Resolving head- of-line blocking in large language model serving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.130836Z"},"links":{"cited_paper":"/paper/2407.00047","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:a67f79e9ce3b5b1f8909b635410b94be66b0a17f7caf6c68df964b27ef36ff24","observation_id":"2ff84f9a-3174-4556-b5be-b792d0ffeb26","resolution":{"observed_at":"2026-08-10T20:35:13.130836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.440238Z","title":"FIRM: An intel- ligent fine-grained resource management framework for SLO-oriented microservices","venue":null,"work_id":"338a85dc-1572-4957-9328-cb31d1d67f71","year":2020},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.135534Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:0b85208e1716f5d92c486a3aba724df2fd98a0eeda49857c4932c6d2e61b4b28","observation_id":"f2895897-a03b-444b-a9fc-4c31be18d0fd","resolution":{"observed_at":"2026-08-10T20:35:13.444865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.427920Z","title":"INFaaS: Automated model-less in- ference serving","venue":null,"work_id":"9115cddf-800b-4ca7-82ad-29b18aa56fcd","year":2021},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.139937Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:d804fef9202ab7d1c91e1b6c0465d3671684b762c23c9a8a9ce4f54e1d239342","observation_id":"c01c5857-4115-4984-9274-a10cf4a5d9f5","resolution":{"observed_at":"2026-08-10T20:35:13.432079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03243","last_updated":"2024-06-05T13:20:18Z","snapshot_observed_at":"2026-08-10T08:10:14.738489Z","submitted_at":"2024-06-05T13:20:18Z","title":"Llumnix: Dynamic Scheduling for Large Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03243","snapshot_observed_at":"2026-08-10T20:35:13.144196Z","title":"Ying Sheng, Shiyi Cao, Dacheng Li, Coleman Hooper, Nicholas Lee, Shuo Yang, Christopher Chou, Banghua Zhu, Lianmin Zheng, Kurt Keutzer, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.144196Z"},"links":{"cited_paper":"/paper/2406.03243","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:023fadae4d6fe8a0b23b5f0879404ac57d6306cf4c0af9142d9aeb5cf3091466","observation_id":"61a8e9f1-e8e6-413d-97f5-cec861972ef5","resolution":{"observed_at":"2026-08-10T20:35:13.144196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.415917Z","title":null,"venue":null,"work_id":"92ab79f3-6df7-4283-b82b-4683f27fa91f","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.148624Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:85c74afeefb914ad26c9d6d5da6d500d07ead46653e699fad6df9683db43b859","observation_id":"9a0d30f1-e83f-427a-91eb-4a700205ef6b","resolution":{"observed_at":"2026-08-10T20:35:13.420114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T20:35:13.153146Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timoth´ee Lacroix, Bap- tiste Rozi`ere, Naman Goyal, Eric Hambro, Faisal Azhar, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.153146Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:cee4d42243306378474ba755ca21c6dc53dd082b3ab4bbcbc936876a3aa9334a","observation_id":"22d56eaf-9306-4611-9a48-5b3f75555985","resolution":{"observed_at":"2026-08-10T20:35:13.153146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.402088Z","title":"Yuxin Wang, Yuhan Chen, Zeyu Li, Zhenheng Tang, Rui Guo, Xin Wang, Qiang Wang, Amelie Chi Zhou, and Xi- aowen Chu","venue":null,"work_id":"edb39283-3a54-409b-9e1a-1d921854b178","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.157148Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:90b4c9d80622b65fd8ea517dbc78e8e1d9f0c1a1990a2896c53a45db5668a7fe","observation_id":"579cba31-9e2e-4911-80ee-585c62ec7d67","resolution":{"observed_at":"2026-08-10T20:35:13.406838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05920","last_updated":"2024-09-25T05:57:51Z","snapshot_observed_at":"2026-08-09T14:08:47.340904Z","submitted_at":"2023-05-10T06:17:50Z","title":"Fast Distributed Inference Serving for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05920","snapshot_observed_at":"2026-08-10T20:35:13.160613Z","title":"Fast distributed infer- ence serving for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.160613Z"},"links":{"cited_paper":"/paper/2305.05920","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:f9cd909569343d84c68c0a7c43c79d56e8e57934b48c6869ebf49dab0fd94b42","observation_id":"ed95b696-47ca-460a-af24-20c9020f173b","resolution":{"observed_at":"2026-08-10T20:35:13.160613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.377116Z","title":"MArk: Exploiting cloud services for cost-effective, SLO-aware machine learning inference serving","venue":null,"work_id":"e4d4eca1-3053-4352-a03c-0216b2844525","year":2019},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.168707Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:8e393de7728cba9b600e5c5ba45725420229b6b42e5dcc17aa117455d38fc806","observation_id":"32e29fd0-6499-4b1a-89ec-b3ccdc6344fa","resolution":{"observed_at":"2026-08-10T20:35:13.381763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15566","last_updated":"2023-11-27T06:31:17Z","snapshot_observed_at":"2026-07-06T16:52:53.954856Z","submitted_at":"2023-11-27T06:31:17Z","title":"SpotServe: Serving Generative Large Language Models on Preemptible Instances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15566","snapshot_observed_at":"2026-08-10T20:35:13.120818Z","title":"SpotServe: Serv- ing generative large language models on preemptible in- stances","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":1967,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.120818Z"},"links":{"cited_paper":"/paper/2311.15566","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:3fa3abf7b1b717df7fbd79935737b329cd4cc5c8b9cf811305a25bae771327f0","observation_id":"2255268d-2f2a-4b0c-9bf2-c152436d7af7","resolution":{"observed_at":"2026-08-10T20:35:13.120818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.500293Z","title":"Clipper: A low-latency online prediction serving system","venue":null,"work_id":"15d93da8-dc5c-4831-a48e-e423c35e97a2","year":2017},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.093941Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:1101a566ca8460caa0baa1704e68e119e61637c3947845d7488784732b292446","observation_id":"34e29414-9d8a-4a57-b0e9-760d64184849","resolution":{"observed_at":"2026-08-10T20:35:13.504719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.465349Z","title":"Efficient memory management for large language model serving with PagedAttention","venue":null,"work_id":"c45fc169-1e98-459d-a344-3ec7acb87852","year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.112566Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:c9646bd0188169a300542a3e0b08f3e83072111836daf8605bcabcca0fd28652","observation_id":"ef95858c-9031-48ab-ac43-26165ecd9874","resolution":{"observed_at":"2026-08-10T20:35:13.468933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.363244Z","title":"Shepherd: Serving DNNs in the wild","venue":null,"work_id":"076a3790-d2d5-4251-acfb-35bb24f23984","year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.172282Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:5d9d1342cc3bf2835def887e786b75aae7ecd24fc6c5d936078bae6a5439e8d9","observation_id":"21c8c925-2b41-4c93-8bb2-912251937640","resolution":{"observed_at":"2026-08-10T20:35:13.369586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.098878Z","title":"ISBN 9781450381376","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.098878Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:4e66d2d23fed8f681b4c66e7c086720bccdcb0b29e782a16e411f3236a89e993","observation_id":"1fc7497b-214c-4343-8e33-f0e38ee16cc5","resolution":{"observed_at":"2026-08-10T20:35:13.098878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.389320Z","title":"The shift from models to compound AI systems","venue":null,"work_id":"9798845d-6cc2-4c47-849f-58ebc3929150","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.164815Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:4057e018228e195598d74984c5e6619a297ce058bb19ef9920e720f39e62360a","observation_id":"5b00cca3-4aef-42f9-a5b8-b7fbc0a0eee8","resolution":{"observed_at":"2026-08-10T20:35:13.393173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.454032Z","title":"TensorFlow-Serving: Flexible, high-performance ML serving","venue":null,"work_id":"1200642c-60b1-4343-b990-d2a55f5208d8","year":2017},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.127198Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:e61aa7c2b2df2c00f852addd52e5fc15a4ac9752a81434e742b12f4f38304e47","observation_id":"1b874990-aab1-4bc3-afed-a9cff19af95f","resolution":{"observed_at":"2026-08-10T20:35:13.458000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-10T20:35:13.089909Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.089909Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:7cfc6603deea79b87ca3cee5933d74372336a998ac6ae78b6abcc32bedd6c148","observation_id":"6d303f27-b015-494d-b5ba-b1a888838a6b","resolution":{"observed_at":"2026-08-10T20:35:13.089909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-11T13:25:51.198142Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 2 inbound Pith citation observations for arXiv:2501.08090."}