{"as_of":"2026-08-20T06:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e0a5a96a804d29a6936c8200e9282ec14eb20bee751c584da55bc4bfe3b5165c","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:55:56.738248Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03036/citation-record","integrity":"/paper/2608.03036/integrity","json":"/paper/2608.03036/citation-record.json","paper":"/paper/2608.03036"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21901","last_updated":"2025-06-27T04:38:20Z","snapshot_observed_at":"2026-08-11T17:40:24.826706Z","submitted_at":"2025-06-27T04:38:20Z","title":"A Survey of LLM Inference Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21901","snapshot_observed_at":"2026-08-15T14:55:56.344634Z","title":"A survey of llm inference systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.344634Z"},"links":{"cited_paper":"/paper/2506.21901","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7729c81ec20123beca65ad06959b29177ef6ad88a4bd3caffced3fddc528dcf7","observation_id":"a3673a36-0aec-45ff-bdbb-d2efb3f18b83","resolution":{"observed_at":"2026-08-15T14:55:56.344634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.350275Z","title":"A survey on evaluation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.350275Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:af15c163ea9b42dc9020e4bc1f5cb61bd76cf55b35d5d3dd1e859d3572ac2d67","observation_id":"e052671b-2ac7-412c-9ed1-46f88f719403","resolution":{"observed_at":"2026-08-15T14:55:56.350275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.354459Z","title":"Towards efficient generative large language model serving: A survey from algorithms to systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.354459Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:593b7822ff067d35cb0cf302b8f6ba9ada9f78cd1f5a871eba1313e5c9f98a95","observation_id":"a444923f-0b42-4494-b014-1fd7ee42d66c","resolution":{"observed_at":"2026-08-15T14:55:56.354459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.358230Z","title":"Thunderserve: High-performance and cost-efficient llm serving in cloud environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.358230Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:fb975cefb9c7355da17328e3c3d1274c59b4ae41ea100c274f3fcf23f6351ae2","observation_id":"be419be5-d137-4cbc-a76c-4673cf824697","resolution":{"observed_at":"2026-08-15T14:55:56.358230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.362518Z","title":"Efficient memory management for large language model serving with page- dattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.362518Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:64d07e894ff89c00ef0b298d2d24e9fca923d5ab21b86b4198efa41fc8cb919e","observation_id":"1a593f6f-8d64-4687-9eda-7fb9492f8522","resolution":{"observed_at":"2026-08-15T14:55:56.362518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.366508Z","title":"Sglang: Efficient execution of structured language model pro- grams,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.366508Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:38bd384198a8a14a526fb7f6e5b77862294ed6f2a3343094f9ce366d7ccf841b","observation_id":"97a8ab5b-6ef9-4536-bcc7-6f47b6043a1b","resolution":{"observed_at":"2026-08-15T14:55:56.366508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.370426Z","title":"Official document of tensorrt,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.370426Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2fcbcea34dbd1db96656a1063baa810805d8a3d54849f9ad07f18903fa726c3e","observation_id":"5533bfcc-abeb-4f38-b73e-1d70731c25e3","resolution":{"observed_at":"2026-08-15T14:55:56.370426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.374482Z","title":"Official document of lmdeploy,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.374482Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:137f01ad49cf24869cc631d0c32aa3f66eb039f9a4762e0f9c07fbbc75b53fa4","observation_id":"a355b0e5-8cd3-4eaa-a0ed-df71cb5a72f1","resolution":{"observed_at":"2026-08-15T14:55:56.374482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.377992Z","title":"Official document of flashinfer,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.377992Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e6b2c4407e16cb0211d391ca2b5161dac9a22c8cf89a14c58ae3eb69fdf543d4","observation_id":"e9df915f-3e37-4ed3-a527-2226fa50f0ea","resolution":{"observed_at":"2026-08-15T14:55:56.377992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00625","last_updated":"2024-12-29T17:38:32Z","snapshot_observed_at":"2026-08-16T14:30:33.338152Z","submitted_at":"2024-01-01T01:12:42Z","title":"Beyond Efficiency: A Systematic Survey of Resource-Efficient Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00625","snapshot_observed_at":"2026-08-15T14:55:56.381697Z","title":"Beyond efficiency: A systematic survey of resource-efficient large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.381697Z"},"links":{"cited_paper":"/paper/2401.00625","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ca3c7dc29f9ffeef9b7ef668753c96c867037486170514dce169f217106938bb","observation_id":"a1676db1-6079-4001-8d51-2da8faf011ae","resolution":{"observed_at":"2026-08-15T14:55:56.381697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-19T14:32:38.763371Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-15T14:55:56.385913Z","title":"Efficient large language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.385913Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9e4e0fe49ee81c378ac788766e191ccbdac6383b8c71b3a67bd43f21fe2077ec","observation_id":"ec33ef9f-be68-476f-8a3e-c89ac65c5000","resolution":{"observed_at":"2026-08-15T14:55:56.385913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08092","last_updated":"2024-09-23T07:37:34Z","snapshot_observed_at":"2026-08-17T22:03:31.093505Z","submitted_at":"2024-01-16T03:35:26Z","title":"A Survey of Resource-efficient LLM and Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08092","snapshot_observed_at":"2026-08-15T14:55:56.390091Z","title":"A survey of resource-efficient llm and multimodal foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.390091Z"},"links":{"cited_paper":"/paper/2401.08092","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f0604b15447b1d8162194fd0d9c5e29bf375584c1c570e457a8623c0b8659be8","observation_id":"d6ffad8b-2c7e-4e33-997d-4f4dd601b778","resolution":{"observed_at":"2026-08-15T14:55:56.390091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.397429Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.397429Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2aabd55cab818510f54aa15d47c76068b127d069e83d9a991c5f9e07b31a9dcf","observation_id":"5df508dc-a31c-424f-828c-90152a5cc94c","resolution":{"observed_at":"2026-08-15T14:55:56.397429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09748","last_updated":"2024-02-15T06:58:30Z","snapshot_observed_at":"2026-08-16T14:18:24.674010Z","submitted_at":"2024-02-15T06:58:30Z","title":"Model Compression and Efficient Inference for Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09748","snapshot_observed_at":"2026-08-15T14:55:56.400818Z","title":"Model compression and efficient inference for large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.400818Z"},"links":{"cited_paper":"/paper/2402.09748","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:554f0b4ff57279da35566032337e32919e348f12b0c3691b0bdcf82cbc69b1a4","observation_id":"689dfee7-f42a-425c-9be6-262a46233833","resolution":{"observed_at":"2026-08-15T14:55:56.400818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.404285Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.404285Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c7c70dc27da5a4d3e7c1bd16826b60bf9e35120b7c128ac93f2986dde82b6f53","observation_id":"bbb05503-d6d7-459e-8704-7e3ab046db8f","resolution":{"observed_at":"2026-08-15T14:55:56.404285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14618","last_updated":"2024-04-22T23:06:42Z","snapshot_observed_at":"2026-08-19T18:40:41.056291Z","submitted_at":"2024-04-22T23:06:42Z","title":"Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14618","snapshot_observed_at":"2026-08-15T14:55:56.408267Z","title":"Hybrid llm: Cost-efficient and quality-aware query routing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.408267Z"},"links":{"cited_paper":"/paper/2404.14618","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:cf071f6385fd1457aebae475758ec35348d56242ef199b9dc805bd283ed0f4c8","observation_id":"5835481e-a495-4a67-b0b1-29c78bc9202a","resolution":{"observed_at":"2026-08-15T14:55:56.408267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.413557Z","title":"{Cost-Efficient}large language model serving for multi-turn conversations with{CachedAttention},","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.413557Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f90e5b2f8778a7791ad418f2611c395e717cb6c6729c59913af8f7e2d6011691","observation_id":"90d5df3a-1865-46fa-834e-b508b34b7a38","resolution":{"observed_at":"2026-08-15T14:55:56.413557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10285","last_updated":"2023-09-19T03:20:02Z","snapshot_observed_at":"2026-08-18T05:11:23.560462Z","submitted_at":"2023-09-19T03:20:02Z","title":"Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10285","snapshot_observed_at":"2026-08-15T14:55:56.417189Z","title":"Flash-llm: Enabling cost-effective and highly-efficient large generative model inference with unstructured sparsity,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.417189Z"},"links":{"cited_paper":"/paper/2309.10285","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:82e2e68a50f658b27668aef8214405192ef830c24cf7f0b82fea073eaf1555b2","observation_id":"8b0c0ae6-aea2-4b2f-be65-e4d50e01addb","resolution":{"observed_at":"2026-08-15T14:55:56.417189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.420832Z","title":"Evaluation of tools and frame- works for machine learning model serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.420832Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:15ad90803034b409b1ee9e5d39786681263eb57df1757b589e348da2c0fff5ca","observation_id":"51420edf-b54f-4994-895d-517031d632bc","resolution":{"observed_at":"2026-08-15T14:55:56.420832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03648","last_updated":"2025-02-22T07:07:38Z","snapshot_observed_at":"2026-08-19T21:34:59.910432Z","submitted_at":"2025-02-22T07:07:38Z","title":"AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03648","snapshot_observed_at":"2026-08-15T14:55:56.424216Z","title":"Aibrix: Towards scalable, cost-effective large language model inference infrastructure,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.424216Z"},"links":{"cited_paper":"/paper/2504.03648","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:df5a5d04c2a157433670f7acf0fc192023e97d46c30d9aa9c9fc4da77f3b238d","observation_id":"3fd652c3-fb28-401e-8674-b525ca14bc30","resolution":{"observed_at":"2026-08-15T14:55:56.424216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.427615Z","title":"Majidi, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.427615Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f862e86e7824b46306d5bc6025d22f01f488597be80c11d92062f9460bd07823","observation_id":"49beadff-3266-48e5-ac2f-55b1f20591be","resolution":{"observed_at":"2026-08-15T14:55:56.427615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.431184Z","title":"What is artificial intelligence (ai)?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.431184Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:98b8db4056989670faae115a326a3387cebd45b38a3eca3efc45e669508ff6b7","observation_id":"4fc7c856-2ce8-43c5-91f8-a1b6d37cc651","resolution":{"observed_at":"2026-08-15T14:55:56.431184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.434447Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.434447Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:487b6c26c0750e378ed7baf0957de9f5244c33956a9665ac2fba268537fa99b5","observation_id":"06ee8274-b6c8-4cd4-9a77-07c008dfec4c","resolution":{"observed_at":"2026-08-15T14:55:56.434447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.437948Z","title":"Defining intelligence: Bridging the gap between human and artificial perspectives,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.437948Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:dd619ae366dec7c34c2b95f48472e58fce32b46c8a968770005f04243c6ba5ac","observation_id":"f8aed055-b4ce-4386-bc90-eecca482c520","resolution":{"observed_at":"2026-08-15T14:55:56.437948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.441337Z","title":"Generative ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.441337Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5a682285d65e63cd37f68ce5ea169a5d1590dbcf46d7cf4a6611be89e1bc4e3b","observation_id":"a6156760-6396-491a-b093-fd00ef40b5a4","resolution":{"observed_at":"2026-08-15T14:55:56.441337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.444957Z","title":"Generative artificial intelligence,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.444957Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d1e4e8a131eff39a6dd98b79ad56383b74025fa684af94b23a84877a7f030a45","observation_id":"7293cc59-7ed0-4d35-86c2-b40bc2d4e7f4","resolution":{"observed_at":"2026-08-15T14:55:56.444957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.448436Z","title":"What is generative ai?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.448436Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7c4196adf7292e72c607e684cb9a344fdf62ea529a71ecc22e56a0efe95ba93c","observation_id":"52292cf6-a111-4115-949f-751e87e6ae09","resolution":{"observed_at":"2026-08-15T14:55:56.448436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-15T14:55:56.451963Z","title":"A comprehensive overview of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.451963Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:111cec16e67481a2b29f66bbe6f5444dc74547e1473c6cd8003581bf60f52dc4","observation_id":"205b5eae-0d39-49c0-b184-5a39a1b01124","resolution":{"observed_at":"2026-08-15T14:55:56.451963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.455877Z","title":"What are large language models (llms)?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.455877Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:df048ebb1dbe17bb9203523677e019872d5a2055d9d64579c12acd13fb2bc71f","observation_id":"4833ccf9-aaab-4962-af0e-576380656b31","resolution":{"observed_at":"2026-08-15T14:55:56.455877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.713730Z","title":"Large language models meet nlp: A survey,","venue":null,"work_id":"b2b79d4c-4d17-46bf-999e-c124f009c745","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.459288Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c2934bd8d21e40ddd708fe90cc0e0007f3471502a2b249951798f152d2cf2bf3","observation_id":"f05dd931-24fb-4f40-97a1-95c4bcd6a7fa","resolution":{"observed_at":"2026-08-15T14:55:57.717611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-15T14:55:56.462860Z","title":"Large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.462860Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9b77ee645c8727ccea52d989f6dad7202cf3ce775d0e4ad8e3d4a90c3800adb2","observation_id":"6bf6f9b4-1226-488f-a548-774416c90592","resolution":{"observed_at":"2026-08-15T14:55:56.462860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.466417Z","title":"A survey on multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.466417Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2731f4f725c50eba5087cac2fcba4213a1a760ca92b04488ffac9e204922ec40","observation_id":"c718c359-8348-4b6d-a05a-c22ca13b928c","resolution":{"observed_at":"2026-08-15T14:55:56.466417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.695567Z","title":"A survey of state of the art large vision language models: Benchmark evaluations and challenges,","venue":null,"work_id":"888b04be-8513-425f-a4bb-669437f8a243","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.469632Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8b2df64ed7e23ff5d0214344b6ca2492151e83d6d4560073f480783cbf1f159b","observation_id":"4d129d69-039e-410d-b9a0-61dc78d136cf","resolution":{"observed_at":"2026-08-15T14:55:57.699422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.684980Z","title":"Large language models in medical and healthcare fields: applications, advances, and challenges,","venue":null,"work_id":"1a20939c-47f3-473e-b5c2-8985dfe18289","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.474119Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7518077dd161d378b049281401aea02f10ffe9700bba3250d0d9d81d2b41f6fb","observation_id":"c7285766-be12-450d-b2dd-7c9808334726","resolution":{"observed_at":"2026-08-15T14:55:57.688799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14165","last_updated":"2024-11-30T22:21:30Z","snapshot_observed_at":"2026-08-16T13:16:37.904827Z","submitted_at":"2024-09-21T15:07:37Z","title":"A Survey on Large Language Model-empowered Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14165","snapshot_observed_at":"2026-08-15T14:55:56.481199Z","title":"A survey on large language model-empowered autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.481199Z"},"links":{"cited_paper":"/paper/2409.14165","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:94395baa79ee9fcf6a7a2a7a6865df606946b9632b0bfc2dcbc51ef6cd5d5cc5","observation_id":"d9d65e2a-35af-47e7-aace-bd47879eaa4c","resolution":{"observed_at":"2026-08-15T14:55:56.481199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.674616Z","title":"Actuarygpt: Applications of large language models to insurance and ac- tuarial work,","venue":null,"work_id":"e7c8fbe3-bcf1-4608-80d3-05dd31c22716","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.484767Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3e63580ed4b755770916b3226e8be3105cc5885e539870364e5190ccd2a03e37","observation_id":"f6c7899e-710a-4547-adc7-559069842108","resolution":{"observed_at":"2026-08-15T14:55:57.678448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11903","last_updated":"2024-06-15T16:11:35Z","snapshot_observed_at":"2026-08-16T13:42:41.036327Z","submitted_at":"2024-06-15T16:11:35Z","title":"A Survey of Large Language Models for Financial Applications: Progress, Prospects and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11903","snapshot_observed_at":"2026-08-15T14:55:56.488867Z","title":"A survey of large language models for financial applications: Progress, prospects and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.488867Z"},"links":{"cited_paper":"/paper/2406.11903","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1606aca2ed88ff9ea1bd62b25064c87e223bbb4b9f79e22a7fef0a23739ac095","observation_id":"22b1023a-e8a0-462f-be27-d48ff8304e2c","resolution":{"observed_at":"2026-08-15T14:55:56.488867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-15T14:55:56.492897Z","title":"A survey on efficient inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.492897Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:a6bac8711f538022d268efe6744d0f624eface93dfec09f2a9dbab994aff9fc0","observation_id":"5cdbc65a-d476-4065-995d-633553ff63fb","resolution":{"observed_at":"2026-08-15T14:55:56.492897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.664068Z","title":"An efficient model maintenance ap- proach for mlops,","venue":null,"work_id":"0b4c7598-c12a-49b6-a4b0-718e88048445","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.496739Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:405ced2fd1c78d54890b76bf26d3508eaa0261e86267d9983831c01767f6ed1f","observation_id":"6fbaf3cc-a677-418e-8cd6-2a0e0d9f82a5","resolution":{"observed_at":"2026-08-15T14:55:57.667615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.653442Z","title":"Sprout: Green generative ai with carbon- efficient llm inference,","venue":null,"work_id":"cdad5062-94c7-4556-b705-b409ab0a512a","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.500582Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:fb142dc57c81e13522ad8ab5b1e0bba06daf1be221dfb91aa1c80a5788a6190c","observation_id":"93cc29c3-d876-434e-b738-9137fc52438f","resolution":{"observed_at":"2026-08-15T14:55:57.657256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.640965Z","title":"Measuring and improving the energy effi- ciency of large language models inference,","venue":null,"work_id":"22e1e936-ae73-4a3b-9244-493f44ea8ea7","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.504833Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d96d2fb4bc180d090393ac401efbb48363e6f2541c23d8b396f82a3a366853ae","observation_id":"625cb309-6809-4c0f-91b8-19299cb14870","resolution":{"observed_at":"2026-08-15T14:55:57.644823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.630563Z","title":"An empirical study on the usage of au- tomated machine learning tools,","venue":null,"work_id":"45ad961d-0e38-4699-a47e-6a333b536902","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.508805Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ae5ed5669e4856841876337e5cd7009b48d01cd3b385dd22cfca104bf49c31a1","observation_id":"219c144b-7d78-43c2-9905-b4567c2a87fd","resolution":{"observed_at":"2026-08-15T14:55:57.634208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.619878Z","title":"Github rest api,","venue":null,"work_id":"bd830318-ffa0-46a7-b4dd-8e26187b98f6","year":2021},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.513108Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7b81d694303a2b8b340235755f3e48029343d4587206f3b87f5d344f36b4a884","observation_id":"fa04e472-1d81-4c54-9ab0-ae4e4143b3b0","resolution":{"observed_at":"2026-08-15T14:55:57.623460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05637","last_updated":"2026-08-03T15:19:02Z","snapshot_observed_at":"2026-08-07T17:01:33.563160Z","submitted_at":"2026-03-05T19:47:26Z","title":"Real Faults in Model Context Protocol (MCP) Software: a Comprehensive Taxonomy","version":2},"cited_work":{"arxiv_id":"2603.05637","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.05637","snapshot_observed_at":"2026-08-15T14:55:57.065573Z","title":"Real Faults in Model Context Protocol (MCP) Software: a Comprehensive Taxonomy","venue":"cs.SE","work_id":"29909d41-f469-44af-9a35-59e31541919d","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.517402Z"},"links":{"cited_paper":"/paper/2603.05637","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c79d58384fa463d0cbaeb333b472a34ec3dd8b6c9da86890ebae99c8a5995b69","observation_id":"147f1170-cb17-4c54-ab00-a9c96bbc7e6b","resolution":{"observed_at":"2026-08-15T14:55:57.069621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06847","last_updated":"2026-05-07T16:46:46Z","snapshot_observed_at":"2026-08-12T19:29:28.939078Z","submitted_at":"2026-03-06T20:12:29Z","title":"Characterizing Faults in Agentic AI: A Taxonomy of Types, Symptoms, and Root Causes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.06847","snapshot_observed_at":"2026-08-15T14:55:56.521463Z","title":"Characterizing faults in agentic ai: A taxonomy of types, symptoms, and root causes,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.521463Z"},"links":{"cited_paper":"/paper/2603.06847","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7461f3c007c600a3cb60af8c684d472d13bb4840c8bd390e7f943fbc80d5994d","observation_id":"20350623-d13c-4078-a282-0b5eb82422d4","resolution":{"observed_at":"2026-08-15T14:55:56.521463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15003","last_updated":"2025-07-20T15:15:58Z","snapshot_observed_at":"2026-08-14T15:15:22.164722Z","submitted_at":"2025-07-20T15:15:58Z","title":"The Rise of AI Teammates in Software Engineering (SE) 3.0: How Autonomous Coding Agents Are Reshaping Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15003","snapshot_observed_at":"2026-08-15T14:55:56.526054Z","title":"The rise of ai teammates in software engineering (se) 3.0: How autonomous coding agents are reshaping software engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.526054Z"},"links":{"cited_paper":"/paper/2507.15003","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:529f9406f33f5ea8cfe24231f3ed90567571bb51d1328ac927e739fb15abe720","observation_id":"9a4e3fc1-a82b-4b69-ba6a-1e75fa6dbccf","resolution":{"observed_at":"2026-08-15T14:55:56.526054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.608976Z","title":"Bug character- ization in machine learning-based systems,","venue":null,"work_id":"89cd68b0-8aa8-4593-9c3b-fb3319f458e2","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.530416Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:544733f50162efaeda2b99bca8be7c6d4b1a2b97ad1de537afff09bc41091fdb","observation_id":"da7f103a-799b-4d3f-8885-db3ae56842a1","resolution":{"observed_at":"2026-08-15T14:55:57.613124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08172","last_updated":"2024-11-12T20:32:36Z","snapshot_observed_at":"2026-08-17T21:29:54.043598Z","submitted_at":"2024-11-12T20:32:36Z","title":"Fault Localization in Deep Learning-based Software: A System-level Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08172","snapshot_observed_at":"2026-08-15T14:55:56.534446Z","title":"Fault localization in deep learning- based software: A system-level approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.534446Z"},"links":{"cited_paper":"/paper/2411.08172","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c8990435674b814c1f1c4bfe12a4b7db6a07189949534c0beda6fff00dd14b3e","observation_id":"119aeb00-9a17-4e66-93c0-011282f4c180","resolution":{"observed_at":"2026-08-15T14:55:56.534446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.598772Z","title":"Bugs in machine learning- based systems: a faultload benchmark,","venue":null,"work_id":"104fee8e-dc0a-46a5-8ff8-67ed9a052461","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.538915Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:163f75ea5914efdb7c6a7913b827764e93be54d0df938839013fef56c9468541","observation_id":"663148f4-c589-4b8d-9978-0d8b1d596766","resolution":{"observed_at":"2026-08-15T14:55:57.602363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.588811Z","title":"Official document of vllm,","venue":null,"work_id":"f97544ec-3d80-4aac-820b-331728a9f4f6","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.542930Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:035d597b47ae2502f192b77d13178f49aeaa5e0bec74ed17cd4b4cc36531e5c7","observation_id":"8fb0cac4-0a9d-4619-a098-9d5b5419d5f0","resolution":{"observed_at":"2026-08-15T14:55:57.592224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.578267Z","title":"Abstract syntax tree,","venue":null,"work_id":"d3beeaf3-0df6-48a1-96a9-0992c0953903","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.546682Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1a499dc92057fadd23f1d832b907269fdfd5acafdb6941b330c63dd0084da8f4","observation_id":"233b346d-d04d-4891-aff1-e68d7816e3c1","resolution":{"observed_at":"2026-08-15T14:55:57.581807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.567449Z","title":"About readmes,","venue":null,"work_id":"5dbde51d-d099-4f44-becf-a203e5421b04","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.551260Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e4420cb179b239bd87351a5e2c8f82f65b039f582b98f648f12e931498609e80","observation_id":"568902fa-dfa8-4be8-b60d-a58e50ff187f","resolution":{"observed_at":"2026-08-15T14:55:57.571366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.556715Z","title":"Study the correlation between the readme file of github projects and their popularity,","venue":null,"work_id":"799dfa77-9cc7-4b24-8288-f4cebf2fb558","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.556285Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7676403e904cab6bee039e43fe2c5c8d1e6efcd581a4b088caeb63bfa11a53f2","observation_id":"4a71f241-c938-4098-a0fa-730335c44cf3","resolution":{"observed_at":"2026-08-15T14:55:57.560480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.545972Z","title":"Classifying your repository with topics,","venue":null,"work_id":"2d622134-c4ae-4d7a-ae7f-366efba593a6","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.560238Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2c00da513276d675328c9890e475e5b7f39629529422001c651ef4fec126bed0","observation_id":"230de082-ba69-4f03-9b83-a72331ec6f7d","resolution":{"observed_at":"2026-08-15T14:55:57.549530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.536223Z","title":"(2026) Gpt-4o mini","venue":null,"work_id":"ca615e55-17de-4a24-a270-391647eaf792","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.564302Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1630d05e0d112dd3f07c04a7385bdd9b53bdc5134f7d5fa4325307b8685c30ad","observation_id":"4115aaaa-a834-4cac-8b3b-cf5e5c1e362d","resolution":{"observed_at":"2026-08-15T14:55:57.539557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.13283","last_updated":"2021-10-25T21:50:21Z","snapshot_observed_at":"2026-08-16T17:46:38.810112Z","submitted_at":"2021-10-25T21:50:21Z","title":"Generating GitHub Repository Descriptions: A Comparison of Manual and Automated Approaches","version":1},"cited_work":{"arxiv_id":"2110.13283","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.13283","snapshot_observed_at":"2026-08-15T14:55:57.020426Z","title":"Generating GitHub Repository Descriptions: A Comparison of Manual and Automated Approaches","venue":"cs.SE","work_id":"c0441e9a-87e7-4755-8199-31bb4c8451b4","year":2021},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.568147Z"},"links":{"cited_paper":"/paper/2110.13283","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:fac80a14d97d88b88547c2a414c97179c1be88127c49b41e9639f7d2df5336a7","observation_id":"79e4948d-3af9-4534-8d71-b3071fcfc877","resolution":{"observed_at":"2026-08-15T14:55:57.024863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.524854Z","title":"Mining software reposito- ries for software architecture—a systematic mapping study,","venue":null,"work_id":"a23baa66-b9ac-46e2-af54-1bce24b0e954","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.572312Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8e088d347aa4435828d69084f5fb0e364a6d0ade177a0a38f869000ad645f461","observation_id":"4a2081d3-4ceb-4b47-8413-9f3f50fdafe4","resolution":{"observed_at":"2026-08-15T14:55:57.529568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.514465Z","title":"Uncovering concerns of citizens through machine learning and social network sentiment analysis,","venue":null,"work_id":"186188ae-cac1-4925-bcff-9a13ede3cf0b","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.576130Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2639533caddcad2632f10b8e2b13a3d567478b075f84776d430963f60f37ee3b","observation_id":"c25d43a7-5d1c-461a-8638-3f6271a93321","resolution":{"observed_at":"2026-08-15T14:55:57.517971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01520","last_updated":"2025-02-03T16:56:08Z","snapshot_observed_at":"2026-08-15T23:07:49.317192Z","submitted_at":"2025-02-03T16:56:08Z","title":"Prioritizing App Reviews for Developer Responses on Google Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01520","snapshot_observed_at":"2026-08-15T14:55:56.580296Z","title":"Prioritizing app reviews for developer responses on google play,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.580296Z"},"links":{"cited_paper":"/paper/2502.01520","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:0794b5a32ebee97f8609c2b95d274a2a7927d092f3d5d2b1231f070bc0763da1","observation_id":"7c71447d-61ae-4520-aa30-57f746a34966","resolution":{"observed_at":"2026-08-15T14:55:56.580296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.504092Z","title":"Sentence-bert: Sentence embeddings using siamese bert- networks,","venue":null,"work_id":"bac1af10-cb00-4bbb-ad49-15e4f8e21fd8","year":2019},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.584347Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:0daf1bd226335b273bbf9ecf0391f4659ed7b7eba7e20152f494cf27c80edd95","observation_id":"a18d5f94-057a-402b-a738-920493e98e2f","resolution":{"observed_at":"2026-08-15T14:55:57.507735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19365","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.990498Z","title":"Llm-assisted topic reduction for bertopic on social media data,","venue":null,"work_id":"3f9ed370-05cd-4221-b751-92481d21f106","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.588056Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9dd288ace37e312a1433efe075a5b393bd70d0ff14f4049ec45992e97caae2d9","observation_id":"9d2d3e66-3bc5-484f-8375-8b3caf4bbee6","resolution":{"observed_at":"2026-08-15T14:55:56.996567Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.492932Z","title":"Security vulnerabilities in ai-generated code: A large-scale analysis of public github repositories,","venue":null,"work_id":"50110828-3186-45b1-a68a-12c3f9c332d6","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.591911Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5864c228ff4abfd9a8a51ac0e80b32e40d3e8f98772b8806b56de1bc2fc21a9a","observation_id":"9e997147-2d58-4a1d-a749-2f409b2163b6","resolution":{"observed_at":"2026-08-15T14:55:57.496809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.482344Z","title":"An empirical study of blockchain repositories in github,","venue":null,"work_id":"429b5bf6-ea62-4854-80b8-837b440dce9b","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.595737Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:919bf112a6ac6d27c4346441ef5c99ecd4a2ff15e4699ad4ce43118db70f1ae4","observation_id":"12360636-8f0d-4252-b93d-44bee94fc1ad","resolution":{"observed_at":"2026-08-15T14:55:57.485807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.472295Z","title":"Ray: A distributed framework for emerging{AI}applica- tions,","venue":null,"work_id":"440cc7cb-385f-43cb-ad39-921bb3042d16","year":2018},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.599852Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:13835d2e2edfcc5c7d5e10fc7d43a429f4df0c4e4e6b48747e4591394bbe0f62","observation_id":"5e873c3e-7d3b-48b4-9549-5509f6dcc8df","resolution":{"observed_at":"2026-08-15T14:55:57.475711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.462162Z","title":"Official document of openllm,","venue":null,"work_id":"4c01a55f-d9ac-4b76-80f6-e60e28c9cd49","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.603835Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8d4eec3605bd3709eb60a1290eabac8ddcb4f1d0356514ce3d7bf90bd783dc04","observation_id":"43c24151-d9e2-48c4-8cd5-3711688439d1","resolution":{"observed_at":"2026-08-15T14:55:57.465565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.450433Z","title":"Official document of routellm,","venue":null,"work_id":"3d05a8cb-3577-49a3-8b49-b856354b0123","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.607780Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:a410aef5f72ab57178e1cd8f4938f9e485e63ba53295c2ccb1f2503685391c99","observation_id":"71fd8b85-737f-4d26-b777-051b3a015437","resolution":{"observed_at":"2026-08-15T14:55:57.453789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.439154Z","title":"Official document of sglang,","venue":null,"work_id":"fc0437d9-c50d-44c6-a762-1526b56f00b1","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.611729Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ea3890c886e5768fcf0a460efb5c6217cf0d12d4c3bef995dc71faff8a938674","observation_id":"d2324a7b-271f-4bad-a74c-2bb86b68ba66","resolution":{"observed_at":"2026-08-15T14:55:57.443311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.428438Z","title":"Official document of ray,","venue":null,"work_id":"6f95343a-669c-4e67-b74e-db74ea9ce91d","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.615872Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9416ecb58dcf22a7da62e4d070fc7e8cde173cd2e9235bd5519155c25c409077","observation_id":"03b5b94a-5d94-4b95-a877-8af975eef4d9","resolution":{"observed_at":"2026-08-15T14:55:57.432118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.417848Z","title":"Official document of lightllm,","venue":null,"work_id":"d66ee172-6830-4139-a86f-442d568a115c","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.619642Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:945eab1cef412558a85b41eb2681be48deb411514c395f58c754ec9ceb6c1a31","observation_id":"9bad6075-9da0-4da4-b9e1-31b822136084","resolution":{"observed_at":"2026-08-15T14:55:57.421356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.407418Z","title":"Official document of fastdeploy,","venue":null,"work_id":"c82d07c4-bfe0-4fe0-b72d-2c6c1bfcd452","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.623760Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:967d7e3c8112dbbf9c88b433f95dc3c089381bee63e8bd52e08ed59b407ab9af","observation_id":"3a7c6662-97b8-41f3-ad7f-70b41ce76994","resolution":{"observed_at":"2026-08-15T14:55:57.411029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.396886Z","title":"Flashinfer: Efficient and customizable attention engine for llm inference serving,","venue":null,"work_id":"3fee71ec-8066-433a-872a-93a6f4a7fef0","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.627564Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:828cb40d28a9711a33cd1afb0a385b3ac3fcba64cef71e654634a1acc317f78c","observation_id":"4d926ca6-5db6-4c6f-9c7c-25a4960d64e8","resolution":{"observed_at":"2026-08-15T14:55:57.400858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06709","last_updated":"2025-01-12T04:29:39Z","snapshot_observed_at":"2026-08-16T10:50:40.853881Z","submitted_at":"2025-01-12T04:29:39Z","title":"Mell: Memory-Efficient Large Language Model Serving via Multi-GPU KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06709","snapshot_observed_at":"2026-08-15T14:55:56.631328Z","title":"Mell: Memory-efficient large language model serving via multi-gpu kv cache management,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.631328Z"},"links":{"cited_paper":"/paper/2501.06709","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:efb895cc37a9bb7267d663912a69aa337199068ed68a8d53c81eb24e240563c8","observation_id":"87c72b18-1423-4970-92e9-e9b572cdfcb1","resolution":{"observed_at":"2026-08-15T14:55:56.631328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.635306Z","title":"A universal load balanc- ing principle and its application to large language model serving,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.635306Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3e850b77d91460e56017b770b01592db63f23d3efd7fe65c5b5288ba9fc0f1c9","observation_id":"c7ca2c38-8a98-4558-a2ac-70554602d9cb","resolution":{"observed_at":"2026-08-15T14:55:56.635306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.386067Z","title":"Layerskip: Enabling early exit inference and self-speculative decoding,","venue":null,"work_id":"e2c23486-3acf-411d-b6f0-2879069cfd62","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.639026Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c1edb2e660073b4eb54b67334f07e29e5e938275bcbcb27bf0e61592ff5197ea","observation_id":"d0d9493b-b3e0-48a0-b357-12967a5b239f","resolution":{"observed_at":"2026-08-15T14:55:57.389994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.375978Z","title":"Llm inference serving: Survey of recent advances and opportunities,","venue":null,"work_id":"55610f82-9e60-4148-9eab-ea18591fab65","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.642710Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:58c6e379b9396da3bc68cc9d18e3be2c2daa0f9da3972627bdc8fa4b45cc153a","observation_id":"6a861287-9e5e-4a0f-9a27-43f70c7f2f76","resolution":{"observed_at":"2026-08-15T14:55:57.379657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.646376Z","title":"Efficiently scaling transformer inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.646376Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d8315c877f63b87bc0fff063d11d10f2d335943c7a2be6f1da50f09ed010d3ae","observation_id":"554022d7-55d5-4ee5-9109-d323309fb824","resolution":{"observed_at":"2026-08-15T14:55:56.646376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16712","last_updated":"2025-08-22T14:59:23Z","snapshot_observed_at":"2026-08-16T05:43:37.028746Z","submitted_at":"2025-08-22T14:59:23Z","title":"Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16712","snapshot_observed_at":"2026-08-15T14:55:56.649990Z","title":"Systematic characterization of llm quantization: A performance, energy, and quality perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.649990Z"},"links":{"cited_paper":"/paper/2508.16712","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:01995518ad67385a19d7e36a97f821880a1ba2d994909da731b901b96a3d8682","observation_id":"06070ec0-ff47-4d03-9eaa-e1f5f9863956","resolution":{"observed_at":"2026-08-15T14:55:56.649990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.653752Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.653752Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1b4de747baad7d6b028f7ad297c4c0c8a1d0e54119d2a7bf9cf3ba8b6100d905","observation_id":"f3d52ff8-0ba8-4744-8eb2-0dd4dc50c257","resolution":{"observed_at":"2026-08-15T14:55:56.653752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.353221Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"3a2c93a8-f8c6-4782-9dfb-832e775b876a","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.657509Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:cf118066abafb75ce5bff6e73f7d5c237664f6c9c419cfe9e0392db7a062d0eb","observation_id":"e5e830db-a1d9-4681-90f6-41d890492775","resolution":{"observed_at":"2026-08-15T14:55:57.356960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.342132Z","title":"A survey on lora of large language models,","venue":null,"work_id":"c3f0329e-5e8e-4cf5-817a-b9cd09662f79","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.661068Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:fdcb4316a556c08481f155dddee8b5c0839b8605ea052edbd4c7fa9b66ce3d8a","observation_id":"76375f0f-5095-4700-9843-426a27d14a46","resolution":{"observed_at":"2026-08-15T14:55:57.345808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-18T21:18:20.077927Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-15T14:55:56.665126Z","title":"Reten- tive network: A successor to transformer for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.665126Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ea2b2895b6c7debcfeb7a9cad6d62757ad015780aab2551ddb08326bc120a80c","observation_id":"496a5b22-079e-4db8-86cd-4c02b61f12ed","resolution":{"observed_at":"2026-08-15T14:55:56.665126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.668960Z","title":"Rwkv: Reinventing rnns for the transformer era,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.668960Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f78c5f80bbdca122f670fa183b939942fcb90fdd0d40b8d7420337490143787c","observation_id":"7c3f2ae8-1e60-48f9-805c-417d72994f9e","resolution":{"observed_at":"2026-08-15T14:55:56.668960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02281","last_updated":"2018-03-09T03:37:52Z","snapshot_observed_at":"2026-08-14T20:16:17.375580Z","submitted_at":"2017-11-07T04:42:48Z","title":"Non-Autoregressive Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02281","snapshot_observed_at":"2026-08-15T14:55:56.672535Z","title":"Non-autoregressive neural machine translation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.672535Z"},"links":{"cited_paper":"/paper/1711.02281","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f995e2f842312f5033ab06f97c35659b97067fa86d4f321fa22ddede0e7f25ed","observation_id":"51364055-1a37-4d9b-9f29-044e4e139b1c","resolution":{"observed_at":"2026-08-15T14:55:56.672535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.324864Z","title":"Parallelism and scaling,","venue":null,"work_id":"d5a5967e-4565-4a37-927b-ba137e4e2b76","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.676499Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:0d5ecfe3b84b5d6a733f40c50d5613b68dd9b92ca94ce84be62c933cd0b09b53","observation_id":"748413d1-95e3-4c70-b502-411f6d1d5367","resolution":{"observed_at":"2026-08-15T14:55:57.328674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.314285Z","title":"Performance and tuning: Chunked prefill,","venue":null,"work_id":"ecaefc91-8cb2-46ab-82ad-c080f550ea21","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.680080Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8ce587da0e5458bb3891ead6989c35c7a633277ccd9eec4b953cde78f3863ad1","observation_id":"592c4a65-c676-44d9-8455-1b5b528f2304","resolution":{"observed_at":"2026-08-15T14:55:57.317920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.303905Z","title":"Quantization,","venue":null,"work_id":"22a6a0ec-6b7a-4ac0-9605-18df8dd4f4ba","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.683861Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f45999234abbbf62a97fbbc07656c7ccebd69ae191fa71d82f6a7db70c57d14f","observation_id":"ed466b52-5300-4f47-ae7d-2fcb52c50d34","resolution":{"observed_at":"2026-08-15T14:55:57.307349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.293397Z","title":"Overview,","venue":null,"work_id":"01599f4b-5d76-4425-a4fb-44788818c9fc","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.687284Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3d36931c9ecdac51e8ba9e84976654a6979975c6ab518471702a1facb88cf1b8","observation_id":"283c8bc8-5eaf-4dc4-81d1-1184fef86652","resolution":{"observed_at":"2026-08-15T14:55:57.296897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.281803Z","title":"Multi-head, multi-query, and group-query attention,","venue":null,"work_id":"38c7fb3d-2f5b-4acb-888f-59c3455df0b2","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.690786Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:bf72d474a5fea154d4ce8eb1ce207fbcaa8847f572206fa0d1434371505ca982","observation_id":"6edda610-8161-4981-b982-74b05aad2510","resolution":{"observed_at":"2026-08-15T14:55:57.286012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.270770Z","title":"Parallelism in tensorrt llm,","venue":null,"work_id":"0b88a367-eae9-436d-b018-61dac1ce44bb","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.694831Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:18e17fe7760623cc4ff8854b484054e2b1cde258291bfa660fb5fbbc3f782ca9","observation_id":"a457f8ad-baad-483a-b778-486b1194f0f9","resolution":{"observed_at":"2026-08-15T14:55:57.274793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.259717Z","title":"Quantization,","venue":null,"work_id":"ae587052-9400-413d-ab25-57e55f05d2df","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.698485Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c84959e906940279d931cbee090582329d4ebf1faa8461b2e561c81e992d8b6d","observation_id":"9a9eeff6-34cc-454e-a3dd-428aa712d656","resolution":{"observed_at":"2026-08-15T14:55:57.263490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.247985Z","title":"FlexGen: High-throughput generative inference of large language models with a single GPU,","venue":null,"work_id":"709674b8-77ad-4e15-97df-a771a7caa0cc","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.702164Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:a0f1a956087d557a4ce99889e9a998cbcf8d6ae64787f50c1f64e5f1a70380f6","observation_id":"dace80fa-6d51-48a0-8e36-548887227b73","resolution":{"observed_at":"2026-08-15T14:55:57.251723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.236925Z","title":"DISP-LLM: Dimension-independent structural pruning for large language models,","venue":null,"work_id":"f1c8bf87-1002-4727-811c-b072f73e92ea","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.705921Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e085c7dfd3bcf8bb7da37d98da33074ab240d490485022d4a768edde4caaa5c5","observation_id":"73187ce2-58d1-417a-840e-3e7a7745b292","resolution":{"observed_at":"2026-08-15T14:55:57.240861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.226390Z","title":"Challenges in deploying machine learning: A survey of case studies,","venue":null,"work_id":"1c7e6a8a-81a1-405d-acbb-a261a7b2fa58","year":null},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.709693Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7de614f71bc6136493f4640359d9f479289a8185b2378c6bc1bbf12133c6a979","observation_id":"a83e8c32-0a1b-4330-8389-015c3ff38218","resolution":{"observed_at":"2026-08-15T14:55:57.229967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/technologies12060081","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.767833Z","title":"A survey of machine learning in edge computing: Techniques, frameworks, applications, issues, and research directions,","venue":null,"work_id":"24b3f8d9-ecd6-44f1-b47d-36b7b428e03e","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.718080Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:b93ed13f2f88f2b1387c7c343dab8161104772c32a06c4af2c7b4bdc704f28e8","observation_id":"583995c2-ab6b-48c8-86de-041c811c935b","resolution":{"observed_at":"2026-08-15T14:55:56.773616Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21931","last_updated":"2025-07-29T15:46:26Z","snapshot_observed_at":"2026-08-17T18:23:47.068492Z","submitted_at":"2025-07-29T15:46:26Z","title":"Post-Training Large Language Models via Reinforcement Learning from Self-Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21931","snapshot_observed_at":"2026-08-15T14:55:56.722273Z","title":"Post-training large language models via reinforcement learning from self-feedback,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.722273Z"},"links":{"cited_paper":"/paper/2507.21931","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:a94babc77c2e2db51433a4b30450a3ddb67e0c34464bcbac0287e925fc10455e","observation_id":"4ee668c2-3338-4fac-9708-332017d83d63","resolution":{"observed_at":"2026-08-15T14:55:56.722273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-08-15T17:20:54.840134Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-15T14:55:56.726629Z","title":"Reinforcement learning for reasoning in large language models with one training example, 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.726629Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e762ea48ef6145cb849271ac47657c4660c25b6ad725e2bc09f9ce46b3ea72c7","observation_id":"eb5d1063-ebb3-4017-a5a0-6497f7720951","resolution":{"observed_at":"2026-08-15T14:55:56.726629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00722","last_updated":"2025-06-05T07:54:05Z","snapshot_observed_at":"2026-08-14T13:57:55.592899Z","submitted_at":"2025-02-02T08:44:43Z","title":"Demystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00722","snapshot_observed_at":"2026-08-15T14:55:56.730544Z","title":"Demystifying cost-efficiency in llm serving over heterogeneous gpus,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.730544Z"},"links":{"cited_paper":"/paper/2502.00722","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:4a880f6793719e78cf3e4c8b9563402f8fd9921e85335b26b44c72189e9b398d","observation_id":"fe3d2808-d092-423a-8882-fa0b635a7de0","resolution":{"observed_at":"2026-08-15T14:55:56.730544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.215745Z","title":"A study of llms’ preferences for libraries and programming languages,","venue":null,"work_id":"0398cceb-6910-48fa-bfb1-f0727cf5f722","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.734487Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:16fbfca6d01756e9a9af40f9bec42ac69540b2032f1017918a7eab32a95f29fc","observation_id":"1ff31554-cb92-4038-98a2-64061ab87ccc","resolution":{"observed_at":"2026-08-15T14:55:57.219332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.204746Z","title":"The promises and perils of mining github,","venue":null,"work_id":"1c43f562-4494-4034-b1b7-005409d08d6e","year":2014},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.738248Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:607603458b9f7da9892d4e0e3716a2739e5d3a36044c183efe567ada4d4dfa01","observation_id":"936fbff5-9ebc-410a-aabd-7b63b1fad746","resolution":{"observed_at":"2026-08-15T14:55:57.208455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.713551Z","title":"Available: https://doi.org/10.1145/3533378","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.713551Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1ee2d683f7f727fc912bfc2f11827024f24818dce8f93d43445bade89712fc58","observation_id":"4c301483-5469-4739-af58-26596bd809f9","resolution":{"observed_at":"2026-08-15T14:55:56.713551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-18T00:36:33.289315Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":4,"verified_fuzzy":46},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 0 inbound Pith citation observations for arXiv:2608.03036."}