{"as_of":"2026-08-21T03:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:296b1bec9608b85a0078318bb4902bcd8b3435de911cffd8e44dbeaa400549f3","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:49:32.385870Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.06362/citation-record","integrity":"/paper/2509.06362/integrity","json":"/paper/2509.06362/citation-record.json","paper":"/paper/2509.06362"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:39.269893Z","title":"A survey of knowledge enhanced pre- trained language models,","venue":null,"work_id":"ae420903-95ad-406b-aa33-fe79a853783d","year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:28.635337Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:31b7276c4b1d7d7aec3f0f44bf9f55e3649fe2e2a0c7f3c7df3b94cce6e2543b","observation_id":"74a61d0d-298b-424b-9f7d-54a7bbed734e","resolution":{"observed_at":"2026-08-04T23:49:39.406238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:39.005399Z","title":"Model-as-a-service (maas): A survey,","venue":null,"work_id":"2ff9fb13-1279-4842-a449-31577e916746","year":2023},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:28.729778Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:b452498e430f0fcc479206ea06ae766e703801f3784651d963e8adfea46d8e59","observation_id":"cdfd3d60-1df8-494a-b8a1-ce72ba6292ec","resolution":{"observed_at":"2026-08-04T23:49:39.123174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:38.778329Z","title":"The rise and potential of large language model based agents: a survey,","venue":null,"work_id":"f6ab52d0-45d2-4d12-8e5b-5f879047dd0c","year":2025},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:28.806725Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:606021db593667f9aec3d6bab1b7cc90ed0f81dea99f0f885911d658826c4b00","observation_id":"4fd1bea9-233c-4f4c-91a4-39bb9eea191b","resolution":{"observed_at":"2026-08-04T23:49:38.869277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19334","last_updated":"2024-06-09T11:34:12Z","snapshot_observed_at":"2026-08-18T20:04:35.598854Z","submitted_at":"2024-05-29T17:59:20Z","title":"LLMs Meet Multimodal Generation and Editing: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19334","snapshot_observed_at":"2026-08-04T23:49:29.000176Z","title":"Llms meet multimodal generation and editing: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.000176Z"},"links":{"cited_paper":"/paper/2405.19334","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:aa786338c131d582e95d44d7d70ab09997e3fd5c953c26b2fc6e70ad0c5376ad","observation_id":"01d9ad81-0745-4692-a6d3-a127b2eea998","resolution":{"observed_at":"2026-08-04T23:49:29.000176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10266","last_updated":"2025-08-22T18:41:20Z","snapshot_observed_at":"2026-08-18T14:56:41.218579Z","submitted_at":"2024-01-03T21:35:03Z","title":"Intelligent Condition Monitoring of Industrial Plants: An Overview of Methodologies and Uncertainty Management Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10266","snapshot_observed_at":"2026-08-04T23:49:29.124747Z","title":"Intelligent condition monitoring of industrial plants: An overview of methodologies and uncertainty management strategies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.124747Z"},"links":{"cited_paper":"/paper/2401.10266","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:bb951f5da8fc52d1e21a5745e60ee78690f0535437a078e0181e0ec64e3154dd","observation_id":"dbf870fe-0944-4157-94e3-a32841efe5ee","resolution":{"observed_at":"2026-08-04T23:49:29.124747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14966","last_updated":"2025-06-12T01:39:50Z","snapshot_observed_at":"2026-08-20T16:23:29.314751Z","submitted_at":"2025-04-21T08:48:48Z","title":"SLO-Aware Scheduling for Large Language Model Inferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14966","snapshot_observed_at":"2026-08-04T23:49:29.217377Z","title":"Slo-aware scheduling for large language model inferences,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.217377Z"},"links":{"cited_paper":"/paper/2504.14966","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:e58f1326beb611cdbf89e7bceb4e935239597ddd111bac8bc4db0de333a09c72","observation_id":"d9ed25c2-6a76-479b-b27f-ccf7755b806d","resolution":{"observed_at":"2026-08-04T23:49:29.217377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18009","last_updated":"2025-06-12T21:26:21Z","snapshot_observed_at":"2026-08-17T08:23:33.953813Z","submitted_at":"2024-09-26T16:19:37Z","title":"Control Industrial Automation System with Large Language Model Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18009","snapshot_observed_at":"2026-08-04T23:49:29.352254Z","title":"Control industrial automation system with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.352254Z"},"links":{"cited_paper":"/paper/2409.18009","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:1e064460e4522018aaa9ef76f6a7a57c947850b5602eabc018430b9639d37552","observation_id":"78a59785-b76e-4e89-a2ae-0d0da3823245","resolution":{"observed_at":"2026-08-04T23:49:29.352254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:38.388589Z","title":"Advanced intelligent manufactur- ing in process industry using industrial artificial intelligence,","venue":null,"work_id":"48ccd5dc-3a6c-47f6-b97a-d71b46420522","year":2023},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.414094Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:cc0b6b11a94d79acd6089d5994ed145133c0e6cae6eccbc6f35dc7fc1957250f","observation_id":"75259ac8-05ae-48b1-ad69-0600ff30b7e7","resolution":{"observed_at":"2026-08-04T23:49:38.534744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03590","last_updated":"2024-11-27T21:15:02Z","snapshot_observed_at":"2026-08-16T04:05:19.272086Z","submitted_at":"2024-11-27T21:15:02Z","title":"Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts","version":1},"cited_work":{"arxiv_id":"2412.03590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03590","snapshot_observed_at":"2026-08-04T23:49:32.709426Z","title":"Enhancing Document AI Data Generation Through Graph-Based Synthetic Layouts","venue":"cs.CL","work_id":"598abc58-3e8e-4f78-ba28-02ff962a16b2","year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.458736Z"},"links":{"cited_paper":"/paper/2412.03590","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:e90d13e5f94cb982b37a2f969b12a5b8004db67d960b34f9fc2b76154b7187b3","observation_id":"dee9b8c4-157d-4e70-894b-3fc0c29b6624","resolution":{"observed_at":"2026-08-04T23:49:32.788744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:38.114761Z","title":"Towards a framework for local interrogation of ai ethics: A case study on text generators, academic integrity, and composing with chatgpt,","venue":null,"work_id":"9fbf2264-3a83-460c-a508-a831ba1c778c","year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.554645Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:9131904b41f57702f1e53649a5659ae197106f6b1764e9fae4c931bbde0c8e3c","observation_id":"45c0bc62-3d7e-45f2-86b6-c84c40d41f51","resolution":{"observed_at":"2026-08-04T23:49:38.232145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:37.809378Z","title":"Alpaserve: Statistical multiplexing with model parallelism for deep learning serving,","venue":null,"work_id":"9af62686-fb90-4552-b99d-28d4a6c54561","year":2023},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.648304Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:b45a5a9b6db1113b5b9d00ece43045d98ed953b2ef88a11bf53ba0301fc3e7d5","observation_id":"4ced0d2f-1842-43ac-98f0-cea6f05e3024","resolution":{"observed_at":"2026-08-04T23:49:37.955159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:37.518915Z","title":"Alpa: Automating inter- and intra- operator parallelism for distributed deep learning,","venue":null,"work_id":"58bdb438-6776-4f5f-b0e4-76b67f3ac665","year":2022},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.768834Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:0679778253867e7bdaaa91037a1395f4a8aac184a24f4d830a3b8e097e8063f0","observation_id":"262a0f9c-ec69-4b92-a5b1-e1d8d0129895","resolution":{"observed_at":"2026-08-04T23:49:37.658864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:37.076349Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters,","venue":null,"work_id":"ca0be08f-d7bc-4e9b-b302-73e2473f35a2","year":2020},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:29.964752Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:315458163a92891abc42f2f12873c351230031d47484b0c56b696449ce7afaa5","observation_id":"f487e54d-dc5b-4a44-8edb-8894d0412490","resolution":{"observed_at":"2026-08-04T23:49:37.302835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:36.829799Z","title":"Efficient large-scale language model training on GPU clusters using megatron-lm,","venue":null,"work_id":"a1ce18b8-3b6d-4eff-bd25-2c852b49884a","year":2021},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.094754Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:96535db3fc0df8af40374aeae95a56920b785d280c5e386fda103ff8bbbc4a55","observation_id":"396035ee-f993-4a2e-8c65-843a8102b5fd","resolution":{"observed_at":"2026-08-04T23:49:36.894744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:36.481890Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism,","venue":null,"work_id":"221e9ba6-4460-467d-935c-e2386cd7c04d","year":2019},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.178713Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:97c6fcab63cd37b785e44ec560c3d3b8368d049404fd3f0f0889a18cfc47db85","observation_id":"47803e7c-08e8-4858-b9f6-80caa269b530","resolution":{"observed_at":"2026-08-04T23:49:36.679905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:36.191308Z","title":"Pipedream: generalized pipeline parallelism for DNN training,","venue":null,"work_id":"78c6ab01-2e21-496d-826a-11e1cac78250","year":2019},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.364748Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:10ddd7fe63f44cd9c3f7fc0bc96505ecc9db4387014a9c1176ffe2e9ce392443","observation_id":"b0045f25-9a30-42b5-a352-93e7e4598008","resolution":{"observed_at":"2026-08-04T23:49:36.297887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:35.865123Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":"57532025-a06a-48ee-8741-5268af5e3b03","year":2023},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.535274Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:923e75378121a102ba6371a6d7794e617121f2daab6d3b1e4c5ddb40c1a09c79","observation_id":"64fada89-301c-49a8-a594-18b4feec8e28","resolution":{"observed_at":"2026-08-04T23:49:36.024293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:35.460159Z","title":"Sglang: Efficient execution of structured language model programs,","venue":null,"work_id":"a0e82440-8586-4768-a69e-ec5e0d8805b4","year":2024},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.665181Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:9fdec190ccbfd200b95ef366462453e7491a93c60bd9530c2d6f4ba1b74ef1d5","observation_id":"1b160eab-3434-4b6b-95f9-965e9d26893f","resolution":{"observed_at":"2026-08-04T23:49:35.675197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:35.182972Z","title":"Orca: A distributed serving system for transformer-based generative models,","venue":null,"work_id":"c486e2d1-3646-41a2-af1b-d4a57e6d916f","year":2022},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.812286Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:3d40b556996fe1efe94ee7fcc048dbc96a99fd01d3ccff7dab3060bfdba6891a","observation_id":"37ffac39-53e4-43bc-93ab-a9d1e5025f2e","resolution":{"observed_at":"2026-08-04T23:49:35.278621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09285","last_updated":"2025-05-22T03:32:05Z","snapshot_observed_at":"2026-08-16T12:41:45.796504Z","submitted_at":"2025-04-12T17:09:54Z","title":"DynaServe: Unified and Elastic Execution for Dynamic Disaggregated LLM Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09285","snapshot_observed_at":"2026-08-04T23:49:30.927283Z","title":"Dynaserve: Unified and elastic tandem-style execution for dynamic disaggregated LLM serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:30.927283Z"},"links":{"cited_paper":"/paper/2504.09285","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:9eb09b731d63e560b59491fd523ba353fa11214ad6cd1ea8914e75e50fced11c","observation_id":"f19792ce-130f-41e5-9590-c5c6ee47f099","resolution":{"observed_at":"2026-08-04T23:49:30.927283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:34.928061Z","title":"Borg, omega, and kubernetes,","venue":null,"work_id":"27538e2c-ed26-4636-8713-fc53560334d3","year":2016},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.085235Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:ec87941fa866bd4effdb6b45be74d30eaf3473ad46899af852b33d5de21cb75d","observation_id":"c22c024e-289e-4079-9aca-226c9eb07d30","resolution":{"observed_at":"2026-08-04T23:49:35.027006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:34.629919Z","title":"Nvidia dynamo","venue":null,"work_id":"48f52d7c-8460-4623-94d4-cffd28234fce","year":null},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.162926Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:de965de9c9380361f089f0584af1e53e747aff5b1212015de358ef58a505f708","observation_id":"80145378-544c-439d-85da-45c2a39cb1b9","resolution":{"observed_at":"2026-08-04T23:49:34.766385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11990","last_updated":"2022-02-04T18:02:23Z","snapshot_observed_at":"2026-08-20T20:09:31.615952Z","submitted_at":"2022-01-28T08:59:57Z","title":"Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11990","snapshot_observed_at":"2026-08-04T23:49:31.251317Z","title":"Using deepspeed and megatron to train megatron-turing NLG 530b, A large-scale generative language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.251317Z"},"links":{"cited_paper":"/paper/2201.11990","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:ed610f8b5fecb080898f10e72e9d69711a8c9c4256833efa476aa9db4bd63c70","observation_id":"1ce99e3c-fdb0-4d9b-a830-b1114f96a3b9","resolution":{"observed_at":"2026-08-04T23:49:31.251317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:34.320416Z","title":"Beyond data and model parallelism for deep neural networks,","venue":null,"work_id":"e1c892a0-2407-4199-bbb2-ac7c799fcd34","year":2019},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.364752Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:36c42664e06c7987af9e91d34e1869d0fbffcaba7f33e8980285901240cd4e4d","observation_id":"9b8f9ffc-1cce-4abb-b71c-d940234800cf","resolution":{"observed_at":"2026-08-04T23:49:34.387490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T23:49:31.443587Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.443587Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:113d213cb9a030c6ac8e86276704644a3d69bdeb76b59a6e9ee3cc72d67748b9","observation_id":"fdb18142-a848-48c6-8916-c64d8e36612f","resolution":{"observed_at":"2026-08-04T23:49:31.443587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-04T23:49:31.540516Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.540516Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:e78276650db7938f30b60c78c5f3e72b96b6ba58ef3ac6b468083fc61a8b63a2","observation_id":"463ce327-a4af-43b6-b69f-ecc7ea68e078","resolution":{"observed_at":"2026-08-04T23:49:31.540516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:34.063057Z","title":"Amazon ec2","venue":null,"work_id":"003e3dd3-5d7a-4ebb-93a0-e230a91c94e1","year":null},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.637669Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:fd5e78c460344020d5aa57a168880857844c13c2009ef4b832d9ff3e0de3caa9","observation_id":"b3b5a29f-e7c8-4be7-8096-d1be4a47db34","resolution":{"observed_at":"2026-08-04T23:49:34.163313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:33.814742Z","title":"Serving dnns like clockwork: Performance predictability from the bottom up,","venue":null,"work_id":"f8601370-0753-4d7e-9e14-d39b01e4a086","year":2020},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.783870Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:bb444a4b553cd2567f7012c34bd071d6a41744f289ee13f69aca889b1e38fb51","observation_id":"8f381536-4d64-4d25-9a78-a8948207f133","resolution":{"observed_at":"2026-08-04T23:49:33.936952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:33.595290Z","title":"Inferline: latency-aware provisioning and scaling for prediction serving pipelines,","venue":null,"work_id":"721b4a2f-7992-420f-a4bf-e2dd6cea1ed0","year":2020},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:31.964740Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:9497ff2d3724d1a4c9a80fab1e80dcdb3cfd929c5714fabbe1e45b97308c38d7","observation_id":"9ae1fdde-433d-4883-92aa-a3c2d40bfc11","resolution":{"observed_at":"2026-08-04T23:49:33.709785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:33.293336Z","title":"Nexus: a GPU cluster engine for accelerating dnn-based video analysis,","venue":null,"work_id":"7d1e5bcb-702a-4d22-819b-5f3709d4e233","year":2019},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:32.125227Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:c3a20b8e78f3922ffe501837d99fa49ef1f1e46246a292ccfa9c6d40c450d6b6","observation_id":"ddf0e0c5-df59-40d8-ad5c-b888e4ec8044","resolution":{"observed_at":"2026-08-04T23:49:33.414090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:49:33.050715Z","title":"Clipper: A low-latency online prediction serving system,","venue":null,"work_id":"00b6f2aa-2201-416f-9642-4dcd573d35b1","year":2017},"citing_paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T23:49:32.385870Z"},"links":{"citing_paper":"/paper/2509.06362"},"observation_digest":"sha256:2bb4d7464301d29e0c2463f917ae32ea3a7592112a1b760348f7e32fc7291541","observation_id":"3b069fc1-dd10-4deb-afe0-acb210fe432d","resolution":{"observed_at":"2026-08-04T23:49:33.161438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.06362","last_updated":"2025-09-08T06:23:09Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-17T05:29:24.062406Z","submitted_at":"2025-09-08T06:23:09Z","title":"MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2509.06362."}