{"as_of":"2026-08-17T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42a61ba62faf843f01658f4a4ed6db081d751dd3845e202710010a47433aa3df","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:27:01.856685Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T06:49:04.349040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"cited_work":{"arxiv_id":"2411.15381","doi":"10.48550/arxiv.2411.15381","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15381","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sitara- man, and Hui Guan","venue":"arXiv (Cornell University)","work_id":"d729ed08-9d7f-4b62-acff-41a979be4c5c","year":2025},"citing_paper":{"arxiv_id":"2605.25550","last_updated":"2026-05-25T08:07:47Z","snapshot_observed_at":"2026-07-31T12:35:46.854130Z","submitted_at":"2026-05-25T08:07:47Z","title":"DisagFusion: Asynchronous Pipeline Parallelism and Elastic Scheduling for Disaggregated Diffusion Serving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-29T20:46:51.896596Z"},"links":{"cited_paper":"/paper/2411.15381","citing_paper":"/paper/2605.25550"},"observation_digest":"sha256:c5f0243fed77c82086d91c87f02ed1cc50eb721de7c4cea72982e261d70eed16","observation_id":"f91bb7ea-c123-4962-a7a1-6a9b52d1bebf","resolution":{"observed_at":"2026-06-29T20:53:57.613373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"cited_work":{"arxiv_id":"2411.15381","doi":"10.48550/arxiv.2411.15381","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15381","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sitara- man, and Hui Guan","venue":"arXiv (Cornell University)","work_id":"d729ed08-9d7f-4b62-acff-41a979be4c5c","year":2025},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-08-14T06:21:26.274352Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T05:35:01.339479Z"},"links":{"cited_paper":"/paper/2411.15381","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:75a1420345b4861322095121c7c2fc4161e65e4aa088d04cdd1afedd1e6b1ebf","observation_id":"245aba40-2b5f-4cbe-849f-fc9060b86073","resolution":{"observed_at":"2026-07-03T16:28:39.323307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"cited_work":{"arxiv_id":"2411.15381","doi":"10.48550/arxiv.2411.15381","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15381","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sitara- man, and Hui Guan","venue":"arXiv (Cornell University)","work_id":"d729ed08-9d7f-4b62-acff-41a979be4c5c","year":2025},"citing_paper":{"arxiv_id":"2606.13501","last_updated":"2026-07-02T13:06:12Z","snapshot_observed_at":"2026-08-14T06:21:26.274352Z","submitted_at":"2026-06-11T15:51:10Z","title":"GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T23:50:39.241880Z"},"links":{"cited_paper":"/paper/2411.15381","citing_paper":"/paper/2606.13501"},"observation_digest":"sha256:4919f3f1350e6d982200cd22c663506708667dc401c801ade8fda82fd6a6ae4f","observation_id":"40dac2ac-8156-42d6-8f8f-9a1b85da25d0","resolution":{"observed_at":"2026-07-03T23:59:06.300197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:57.921246+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15381","snapshot_observed_at":"2026-07-14T06:49:04.349040Z","title":"Sitara- man, and Hui Guan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11136","last_updated":"2026-07-13T06:12:41Z","snapshot_observed_at":"2026-08-15T06:25:02.556963Z","submitted_at":"2026-07-13T06:12:41Z","title":"Xema: Efficient Diffusion Serving through Fine-Grained Memory Management and Auto-Configuration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T06:49:04.349040Z"},"links":{"cited_paper":"/paper/2411.15381","citing_paper":"/paper/2607.11136"},"observation_digest":"sha256:c930e193ffba133f9031ce27c9c78922058063feb33b4c28e1252fcb31bc1cfd","observation_id":"9f45b247-6672-4d76-81e7-15703380acc9","resolution":{"observed_at":"2026-07-14T06:49:04.349040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15381/citation-record","integrity":"/paper/2411.15381/integrity","json":"/paper/2411.15381/citation-record.json","paper":"/paper/2411.15381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.888009Z","title":"https://archive.org/details/archiveteam-twitter-stream-2018-04, 2018","venue":null,"work_id":"93589afc-08aa-4b8e-8577-a5715d349dd7","year":2018},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.595608Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:cac8eae0191591a63863a24ef5017a074ee2093d64d58823bc4c6a2e69fa489c","observation_id":"6b339838-4b1f-4ca5-8aef-35986f752893","resolution":{"observed_at":"2026-08-12T14:27:02.893254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.871265Z","title":"build, train, and deploy machine learning models at scale","venue":null,"work_id":"5a1904b2-5a06-4bec-8bd0-2061698e028f","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.601213Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:8d1d72fee6d096fc90f986044939df4f0f6a687df18169734d08535e8a568884","observation_id":"3f516ddc-f2b9-4a5d-bab4-6bcc75ed5b41","resolution":{"observed_at":"2026-08-12T14:27:02.876943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.854552Z","title":"https://developer.nvidia.com/nvidia-triton-inference-server, 2022","venue":null,"work_id":"7b7f4b66-8a3e-48f4-b6ca-76ee85f6e1c0","year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.606258Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:39500fb4d494ee8da871f7e24fdd6920b2cebe578e4a378a4174c3bcc6e1bb73","observation_id":"8f690e63-0b8b-462d-bf61-ea9fd31dfbec","resolution":{"observed_at":"2026-08-12T14:27:02.859926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.838231Z","title":"Adobe firefly","venue":null,"work_id":"e3a19470-491b-4120-99d5-3e0bb10b6423","year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.611958Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:2ff0ceb3fd047ed3f04bed955e661eaa610e58e00be7f474e40666f9ed1db9ee","observation_id":"86fedf91-a8dc-47e3-aea6-4273b14aee71","resolution":{"observed_at":"2026-08-12T14:27:02.843476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.821964Z","title":"D., Williams, T., Sitaraman, R","venue":null,"work_id":"7c806839-d78b-44f8-a0c7-80f7e5124992","year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.617052Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:7a8228025229ff638ad149350bc16ca60ee90b640ce8a9f05d5ccb40d2313936","observation_id":"58999957-9aff-4a58-880e-3deefce50e6a","resolution":{"observed_at":"2026-08-12T14:27:02.826968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.804726Z","title":"Batch: Machine learning inference serving on serverless platforms with adaptive batching","venue":null,"work_id":"4fa24d15-9740-4619-aaa4-e983697479f9","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.622178Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:0af7fc2d17ce26cf9d10ce3d4441b2af1c45fabe64a0e74fd16f4a7bf812ff0f","observation_id":"ec542047-654e-44bc-b8c1-dbe7c2be5ffe","resolution":{"observed_at":"2026-08-12T14:27:02.810385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.787875Z","title":"Adaptive neural networks for efficient inference","venue":null,"work_id":"c35aeac8-34db-4edd-ac78-e6dae70247b3","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.627824Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:2d75ef7cf13cb50d4b407c730ea711db4b6fe2663d093dd6362d8cf9a371b00f","observation_id":"c8ff1979-f004-4dfa-bb97-b99e5955f732","resolution":{"observed_at":"2026-08-12T14:27:02.792984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-12T14:27:01.632654Z","title":"Frugalgpt: How to use large language models while reducing cost and improving performance, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.632654Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:915f10242ee07a003795bf3944095ac9c3c656555a0a6167a9bdaf1f44dbfd6b","observation_id":"93b30f8b-798e-404c-b557-c20d29f92779","resolution":{"observed_at":"2026-08-12T14:27:01.632654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.769710Z","title":"J., Gonzalez, J","venue":null,"work_id":"b8ffe52b-a13b-4c14-b6fd-46b56699261b","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.637742Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:9bf362390129146c4cac7b184bcb8e6674e8a5f1d059803bd4187843b2abf443","observation_id":"d2c6f702-a993-49e4-8ad1-dd4d94f6d50c","resolution":{"observed_at":"2026-08-12T14:27:02.775787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.753650Z","title":"J., Gonzalez, J","venue":null,"work_id":"abad4acf-4d19-470e-88db-608fcde2c241","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.642574Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:5292e3abe40575df6c7deefafed0b120e66234bc42b08c23446b7542b6bf7612","observation_id":"1af2c845-98d8-4cb8-bd55-9faa881b24c6","resolution":{"observed_at":"2026-08-12T14:27:02.758588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.737043Z","title":"Inferline: latency-aware provisioning and scaling for prediction serving pipelines","venue":null,"work_id":"f60eee2e-4114-468f-8d09-01027b3243e7","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.647120Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:e997f0024117e28f53497b356a2d03c43fd82105be306e4fcad3e1d489066e4a","observation_id":"5511b38f-1a35-4125-8dab-0aeb9a02a198","resolution":{"observed_at":"2026-08-12T14:27:02.742137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14618","last_updated":"2024-04-22T23:06:42Z","snapshot_observed_at":"2026-08-16T23:10:32.223527Z","submitted_at":"2024-04-22T23:06:42Z","title":"Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14618","snapshot_observed_at":"2026-08-12T14:27:01.652242Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.652242Z"},"links":{"cited_paper":"/paper/2404.14618","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:1780b7e87c70bef95b65aa126667db93b3ae95439ead0cf1c405f50d8bf7aad7","observation_id":"e5d89cde-ccfc-4b19-bac1-99bf2d7ce8c4","resolution":{"observed_at":"2026-08-12T14:27:01.652242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T14:27:01.657683Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.657683Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:51738cc71ef6bc8200afec9ea8157ddcc4fce02e0b400ab961c618c21a55bfed","observation_id":"2b3756cf-e1f7-4930-b950-1b63b1470ed1","resolution":{"observed_at":"2026-08-12T14:27:01.657683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.720868Z","title":"Serving \\ DNNs \\ like clockwork: Performance predictability from the bottom up","venue":null,"work_id":"0315ae37-ad02-43ab-84c1-d49e12e5bfdb","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.663000Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:4408ab09fa0e8c837faa75a91c964e0c887144cf859e1a10ffd6daded9217858","observation_id":"8d171270-cf19-41ae-9fa3-1077eb2cbab0","resolution":{"observed_at":"2026-08-12T14:27:02.726100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.703123Z","title":"R., Mishra, C","venue":null,"work_id":"f88fbd8d-d733-4a80-b580-86afdd549dbe","year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.667892Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:76c52df6b735035a8a49ecf0b8fcbba796cfcd2ac6f18253d41c652dd1f15503","observation_id":"c6e34ff0-4642-4fa4-a7b2-cb0676c77479","resolution":{"observed_at":"2026-08-12T14:27:02.708691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.685585Z","title":"Sommelier: Curating dnn models for the masses","venue":null,"work_id":"63a185a0-e67f-4a96-a68d-eefc6acc01ab","year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.672853Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:3184211730e46a6d88edae6acdc76bf099092cf83ac388c2de36482378486be7","observation_id":"8bead135-69f7-4fc0-bca4-b0912a73c18e","resolution":{"observed_at":"2026-08-12T14:27:02.690982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10136","last_updated":"2024-04-15T21:02:48Z","snapshot_observed_at":"2026-08-16T14:00:41.233757Z","submitted_at":"2024-04-15T21:02:48Z","title":"Language Model Cascades: Token-level uncertainty and beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10136","snapshot_observed_at":"2026-08-12T14:27:01.678122Z","title":"S., Menon, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.678122Z"},"links":{"cited_paper":"/paper/2404.10136","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:36eb0ad84bedfa9e52a6765069d4eafa1c52452615cecf1cfb2d6b16e27c2f82","observation_id":"afa21dde-a470-43fe-bd5e-44e1adb90d51","resolution":{"observed_at":"2026-08-12T14:27:01.678122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.668541Z","title":"URL https://www.gurobi.com/","venue":null,"work_id":"3fbbc5a6-c572-4405-9fb8-a05f23c1685c","year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.683265Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:e3279505689118fc8ec66b324fc3913d2b6c0b1cc95fe331512c2e3c203242cb","observation_id":"fb15b216-d4a8-4b73-8447-d9d70d83ae09","resolution":{"observed_at":"2026-08-12T14:27:02.674398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03385","last_updated":"2015-12-10T19:51:55Z","snapshot_observed_at":"2026-07-06T04:39:28.429064Z","submitted_at":"2015-12-10T19:51:55Z","title":"Deep Residual Learning for Image Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03385","snapshot_observed_at":"2026-08-12T14:27:01.688497Z","title":"Deep residual learning for image recognition, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.688497Z"},"links":{"cited_paper":"/paper/1512.03385","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:391474e516e9854c46e21f0ceb8ff781cd742ec6e9106a6e59cee1d8cd6d2920","observation_id":"831dba85-a24b-47af-90bc-7754b85066ce","resolution":{"observed_at":"2026-08-12T14:27:01.688497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.693864Z","title":"CLIPS core: A reference-free evaluation metric for image captioning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.693864Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:d47a59eab4668042dab865e207b32144184856a39811f3cfa575b93acaec545e","observation_id":"596d9d61-41ed-4515-be45-4f5c66affc04","resolution":{"observed_at":"2026-08-12T14:27:01.693864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.652072Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"c4af180b-b699-41e0-8ee7-4087614f0c1a","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.699078Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:329d23e105be028592db2bafab198eaee633cfa9c404f6215f656b35322b30fb","observation_id":"221f98b3-6b47-4258-b385-46660cb19b42","resolution":{"observed_at":"2026-08-12T14:27:02.657412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.635516Z","title":"Scrooge: A cost-effective deep learning inference system","venue":null,"work_id":"755afa15-ab36-43e3-b231-1781d718bd35","year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.703949Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:a2c886df58ed26951687d63dcac9390243b2a78b3e41c508f446836904051b3f","observation_id":"675856fc-7aa9-4be7-a41c-f922385c0ffc","resolution":{"observed_at":"2026-08-12T14:27:02.640758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.619251Z","title":"Hugging face models hub, 2024","venue":null,"work_id":"0a35c418-32a9-4cc5-a738-26eec09d4690","year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.708704Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:a6bc1ce73b00237b1dd0d607148c715c716de873b64ea18f459fb5530bfce926","observation_id":"8e738f5b-25ea-4398-8501-25fd38922ff3","resolution":{"observed_at":"2026-08-12T14:27:02.624099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01569","last_updated":"2023-11-23T17:07:58Z","snapshot_observed_at":"2026-08-16T15:36:12.925339Z","submitted_at":"2023-05-02T16:18:11Z","title":"Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01569","snapshot_observed_at":"2026-08-12T14:27:01.713566Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.713566Z"},"links":{"cited_paper":"/paper/2305.01569","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:5a58d9a04bbbe4a1cd5cafdc8878306359981aa1a4015422c0251b1022315749","observation_id":"ccba5706-5591-4be1-ad01-5bbfc39aed41","resolution":{"observed_at":"2026-08-12T14:27:01.713566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01974","last_updated":"2020-03-05T16:58:35Z","snapshot_observed_at":"2026-08-17T00:23:49.809207Z","submitted_at":"2019-06-03T22:43:00Z","title":"Willump: A Statistically-Aware End-to-end Optimizer for Machine Learning Inference","version":3},"cited_work":{"arxiv_id":"1906.01974","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.01974","snapshot_observed_at":"2026-08-12T14:27:02.218510Z","title":"Willump: A Statistically-Aware End-to-end Optimizer for Machine Learning Inference","venue":"cs.DB","work_id":"42e32e2b-431a-443f-adc3-eff037a8bca5","year":2019},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.718943Z"},"links":{"cited_paper":"/paper/1906.01974","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:2872c93ac91bc0fc8ca5ac896c1ac13727526803e5324a688b3458a62d747345","observation_id":"6073e157-e86f-4063-9833-cfbb4dcdb6c7","resolution":{"observed_at":"2026-08-12T14:27:02.224872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14682","last_updated":"2021-09-03T13:51:39Z","snapshot_observed_at":"2026-08-16T18:55:30.037832Z","submitted_at":"2020-12-29T09:43:50Z","title":"CascadeBERT: Accelerating Inference of Pre-trained Language Models via Calibrated Complete Models Cascade","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14682","snapshot_observed_at":"2026-08-12T14:27:01.724169Z","title":"Cascadebert: Accelerating inference of pre-trained language models via calibrated complete models cascade, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.724169Z"},"links":{"cited_paper":"/paper/2012.14682","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:717a6e9cc3ef11762316aa7134dcec89deaff0307852dd313156aeeb39b3f60e","observation_id":"e6bee921-81a2-4d50-9fd9-b0c18ccd2fab","resolution":{"observed_at":"2026-08-12T14:27:01.724169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13929","last_updated":"2024-03-02T09:09:32Z","snapshot_observed_at":"2026-08-12T13:08:43.602176Z","submitted_at":"2024-02-21T16:51:05Z","title":"SDXL-Lightning: Progressive Adversarial Diffusion Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13929","snapshot_observed_at":"2026-08-12T14:27:01.729111Z","title":"Sdxl-lightning: Progressive adversarial diffusion distillation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.729111Z"},"links":{"cited_paper":"/paper/2402.13929","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:d9804b1e0e43485498a2967ffbb3fef3e8cf407f26d0f5987e42a500307b2043","observation_id":"ebc4d86d-2161-4947-a409-a2d6f5d06e81","resolution":{"observed_at":"2026-08-12T14:27:01.729111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.734396Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.734396Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:1b1cb4360256f215af59777dc6dc13a44614d3d3f594ec99fade200de509a541","observation_id":"071f4e84-85a7-4aa1-9acc-20a0a828fe2a","resolution":{"observed_at":"2026-08-12T14:27:01.734396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.589592Z","title":"Midjourney","venue":null,"work_id":"51d751b4-9129-4745-89f9-192bc2be6118","year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.739242Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:61600aa7bf9fb3a12ed6d409f3241ce8d7d87eaa1e6b483df8d0ad70ee18e504","observation_id":"1a7ed603-b3e1-4db8-8b5e-54a276106107","resolution":{"observed_at":"2026-08-12T14:27:02.595379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.570554Z","title":"Tensorflow-serving: Flexible, high-performance ml serving","venue":null,"work_id":"ae2df1cf-c432-40d5-993b-a4b323b227a8","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.743995Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:8b65e4f8efdc7c7a7c54f4a599e2eda74bb9717cd73a8e7c374fc25a1db00933","observation_id":"61a01d18-ab89-45a8-b837-01d7674aabc9","resolution":{"observed_at":"2026-08-12T14:27:02.576033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-12T14:27:01.749149Z","title":"Pytorch: An imperative style, high-performance deep learning library, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.749149Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:85f340e5931e33fdce6a32f6bfa3ab43011a50ea9d51abfcc6476070cc65d91c","observation_id":"408dae85-b0fd-44d7-ae8f-c8947e41f859","resolution":{"observed_at":"2026-08-12T14:27:01.749149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T14:27:01.754594Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.754594Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:7af988d485c920f34a334cd22351c42841da477e0e758a7abfd27faa92ce16af","observation_id":"3743c3a7-a30f-4d40-a3b8-f1801f5fa9f3","resolution":{"observed_at":"2026-08-12T14:27:01.754594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.553847Z","title":"Torchserve","venue":null,"work_id":"c3a8033e-3c9b-4148-bedc-0bddbb42111a","year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.760153Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:f7c1363d1b55d9b63963c557e19f914194ec09c268f5a4e436e9cdcb73491b59","observation_id":"d3e8aab3-6934-4a2f-a9cd-e867cf47761f","resolution":{"observed_at":"2026-08-12T14:27:02.559073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.764989Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.764989Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:a28773ebd221af51da24526c4d758011ce05b370b6f913fc5de5f3097b61047c","observation_id":"1f1eb2e6-3714-460f-9e35-e3e656c2b8d2","resolution":{"observed_at":"2026-08-12T14:27:01.764989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.524938Z","title":"J., and Kozyrakis, C","venue":null,"work_id":"3b3ef463-d1c9-4cfc-a60e-576bc7e304bc","year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.769792Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:3a0546143b3b6649715c1aa3f5b3e418e0b39ede57cc41a140d836fde17ccc7e","observation_id":"e847266e-ed6b-4b24-96ac-0a05db6a3a9e","resolution":{"observed_at":"2026-08-12T14:27:02.530876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.774915Z","title":"J., and Kozyrakis, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.774915Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:4888f9f6c3a8db7c6481f759c8f0ece8b5daae0370ee691ef177f6f85ee28f77","observation_id":"9387b0e1-0e28-4c43-9032-838476b8398c","resolution":{"observed_at":"2026-08-12T14:27:01.774915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17042","last_updated":"2023-11-28T18:53:24Z","snapshot_observed_at":"2026-08-16T14:39:31.496511Z","submitted_at":"2023-11-28T18:53:24Z","title":"Adversarial Diffusion Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17042","snapshot_observed_at":"2026-08-12T14:27:01.779693Z","title":"Adversarial diffusion distillation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.779693Z"},"links":{"cited_paper":"/paper/2311.17042","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:6ec6238901943f98ab863a3e6ffc6de051af16ae301af92f48a26d23a2392ea9","observation_id":"5b040390-ec84-4503-bc81-f202af14a8af","resolution":{"observed_at":"2026-08-12T14:27:01.779693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.507496Z","title":"Serverless in the wild: Characterizing and optimizing the serverless workload at a large cloud provider","venue":null,"work_id":"83a74c3d-a461-4d30-b7cd-65b89fd3dee5","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.784847Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:d539c16a1f9c1383bc339da6dc347cfb818fbf7a3aa128eadd0f631200a27e81","observation_id":"c59f4356-5ad6-4298-b962-a5860d120513","resolution":{"observed_at":"2026-08-12T14:27:02.512873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr.2017.236","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.891762Z","title":"Fast video classification via adaptive cascading of deep models","venue":null,"work_id":"eb825eaf-5eec-454d-8b57-7d39243bbb75","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.789531Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:e392e0ee32b2c52b021b19e54077d7d6415d6c46257b1873b325dc90782b6e52","observation_id":"d815e354-5d72-437f-8a28-1efbf8d16643","resolution":{"observed_at":"2026-08-12T14:27:01.899001Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.488738Z","title":"Nexus: A gpu cluster engine for accelerating dnn-based video analysis","venue":null,"work_id":"9a0ed67e-ce59-491b-a086-b070ef882766","year":2019},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.794294Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:3a608e4b14ab389125bf397a781ac64fef7d448c5a78f96b76c18756e726ee7c","observation_id":"19ee7a8c-2775-49ec-a92d-3270d01c7919","resolution":{"observed_at":"2026-08-12T14:27:02.495517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.470435Z","title":"F., Thompson, J","venue":null,"work_id":"d8f33d57-19f3-40c5-a98f-675e0060d8ae","year":2018},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.799021Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:cf80c09fc0a3bd37884f7c6672f2097dab62b19355b5b740434132bd87f3ca6e","observation_id":"ff5a7a63-9d26-40fb-b520-776126789cc3","resolution":{"observed_at":"2026-08-12T14:27:02.476846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16627","last_updated":"2024-04-17T02:57:58Z","snapshot_observed_at":"2026-08-16T14:06:44.772809Z","submitted_at":"2024-03-25T11:16:23Z","title":"SDXS: Real-Time One-Step Latent Diffusion Models with Image Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16627","snapshot_observed_at":"2026-08-12T14:27:01.804062Z","title":"Sdxs: Real-time one-step latent diffusion models with image conditions, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.804062Z"},"links":{"cited_paper":"/paper/2403.16627","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:306170affa98da76c30778d994b119a31b4ff7dac9b0dc83e53a7f3003e79e5c","observation_id":"c13e7ee5-d1f4-47af-ad5f-386596fee70a","resolution":{"observed_at":"2026-08-12T14:27:01.804062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.452698Z","title":"Tensorflow serving","venue":null,"work_id":"33c4d64a-7706-4b3b-b0b6-0efdf21dc630","year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.809350Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:df2851776c73fda684b72e6e17c865ab3a805299d7328c09c83159625a8dea64","observation_id":"13a5051f-25bc-4043-a85b-7fef7d6c38b6","resolution":{"observed_at":"2026-08-12T14:27:02.458559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.434293Z","title":"and Jones, M","venue":null,"work_id":"7db07fcf-2f6f-4c87-802a-83d627c31d1c","year":2001},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.814699Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:394787c9c647c83fe167accddba787ab9c29bfe9b0a0313f2757aabb6ef23d4f","observation_id":"3c9d8c47-a515-4899-88e0-8d96b6993664","resolution":{"observed_at":"2026-08-12T14:27:02.439690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.819689Z","title":"Diffusers: State-of-the-art diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.819689Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:25e3c8172b3057e29b3d8633149bc8140805d115a8c5b78b82510487dc3a61e0","observation_id":"59fbc0a5-2a44-49ed-819a-3e18267f3e40","resolution":{"observed_at":"2026-08-12T14:27:01.819689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06087","last_updated":"2018-04-17T07:54:55Z","snapshot_observed_at":"2026-08-14T19:25:12.889375Z","submitted_at":"2018-04-17T07:54:55Z","title":"Rafiki: Machine Learning as an Analytics Service System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06087","snapshot_observed_at":"2026-08-12T14:27:01.824439Z","title":"K., and Ooi, B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.824439Z"},"links":{"cited_paper":"/paper/1804.06087","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:839127d5bfadb7dc3257b5acd72579172c432d0fb2766a44e19af4364dbe4fe3","observation_id":"adb7d2c2-4ffe-401a-b5ef-2a1263f5640a","resolution":{"observed_at":"2026-08-12T14:27:01.824439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.830067Z","title":"Tabi: An efficient multi-level inference system for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.830067Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:63f241357b1748f6bb63ec5e37962356ecfc36e363050d2fc4805673bc916f1b","observation_id":"89663e8d-cda5-4c9d-9623-e969ec33819b","resolution":{"observed_at":"2026-08-12T14:27:01.830067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14896","last_updated":"2023-07-06T11:53:19Z","snapshot_observed_at":"2026-08-16T16:20:53.427900Z","submitted_at":"2022-10-26T17:54:20Z","title":"DiffusionDB: A Large-scale Prompt Gallery Dataset for Text-to-Image Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14896","snapshot_observed_at":"2026-08-12T14:27:01.835347Z","title":"J., Montoya, E., Munechika, D., Yang, H., Hoover, B., and Chau, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.835347Z"},"links":{"cited_paper":"/paper/2210.14896","citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:649fe4b146ccccddcfd4292029e2ca749b5c197838182fca3fc3c9dcf99e800b","observation_id":"95183afe-e1c2-4a92-8924-015001f28317","resolution":{"observed_at":"2026-08-12T14:27:01.835347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.404243Z","title":"Bartscore: Evaluating generated text as text generation","venue":null,"work_id":"b1041c9a-f3cf-4d90-95b7-122bea9ad765","year":2021},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.841104Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:978a7272c860a3474f13279643675c243e306d1d36a687d896c9f3b32dbf386c","observation_id":"ef582d90-0749-4755-ae06-615f15cc131c","resolution":{"observed_at":"2026-08-12T14:27:02.410087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.386911Z","title":null,"venue":null,"work_id":"587e4dad-c26d-4869-80b4-fbc6186ca72c","year":2017},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.846613Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:1c200856c33b3fad16e7956fc05513b1ca9f260eaf989509fd872ebd515dcb2b","observation_id":"009eb8c5-4744-4047-8ab1-5ddf6b08bfd3","resolution":{"observed_at":"2026-08-12T14:27:02.392540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:02.368732Z","title":"\\ Model-Switching \\ : Dealing with fluctuating workloads in \\ Machine-Learning-as-a-Service \\ systems","venue":null,"work_id":"e070c1a3-1ae4-48ca-a3df-ed7c917e6d6b","year":2020},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.851437Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:a72f04689f8d5ce447ea90a346b2b0530f26fee86787ec6c829036f82f7126f5","observation_id":"9e38a922-a2a5-46c9-bd5c-f1ce786729f0","resolution":{"observed_at":"2026-08-12T14:27:02.374533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:27:01.856685Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T14:27:01.856685Z"},"links":{"citing_paper":"/paper/2411.15381"},"observation_digest":"sha256:ca2a8852020bd063e992b1d7778bda49b8b165827c61e4511dc4eb4ad8dd4d6f","observation_id":"7de3969a-5eb3-4168-9beb-f383f9ca6902","resolution":{"observed_at":"2026-08-12T14:27:01.856685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.15381","last_updated":"2025-05-09T22:31:01Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-16T12:38:56.525360Z","submitted_at":"2024-11-22T23:46:13Z","title":"DiffServe: Efficiently Serving Text-to-Image Diffusion Models with Query-Aware Model Scaling"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 4 inbound Pith citation observations for arXiv:2411.15381."}