{"as_of":"2026-08-09T06:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71660172f459145f99ffabceb9bad8d627d9ec14358cde21e40bb28fd2d79b48","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:31:35.870375Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:00:31.049555Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:29:23.910827Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2505.23970","last_updated":"2026-04-11T06:24:23Z","snapshot_observed_at":"2026-08-04T02:14:18.533002Z","submitted_at":"2025-05-29T19:52:44Z","title":"Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T13:14:26.628447Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2505.23970"},"observation_digest":"sha256:9a70f3c148cbb0966e7b9f88c8467a7b8f2591adcb30c58e1644edf873d34058","observation_id":"a221b0bb-7cbd-4dd3-a0c6-6230172bd29c","resolution":{"observed_at":"2026-05-19T13:17:18.481714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-08-07T11:39:51.789183Z","title":"Ecoserve: Designing carbon-aware ai inference systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01712","last_updated":"2025-06-02T14:21:25Z","snapshot_observed_at":"2026-08-07T11:32:45.632933Z","submitted_at":"2025-06-02T14:21:25Z","title":"A Vertical Approach to Designing and Managing Sustainable Heterogeneous Edge Data Centers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:51.789183Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2506.01712"},"observation_digest":"sha256:76f83fb255e73b61daad6b24f2feea78128ff5a02c72d116050d8dbf6fe1d63a","observation_id":"b30c03c7-b037-462b-9eb6-cf84d54574c4","resolution":{"observed_at":"2026-08-07T11:39:51.789183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-08-06T17:14:19.340515Z","title":"arXiv preprint arXiv: 2502.05043 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11417","last_updated":"2025-07-15T15:44:03Z","snapshot_observed_at":"2026-08-06T17:05:56.882978Z","submitted_at":"2025-07-15T15:44:03Z","title":"Quantifying the Energy Consumption and Carbon Emissions of LLM Inference via Simulations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:14:19.340515Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2507.11417"},"observation_digest":"sha256:8d6523cfcafae56ad197a560711de0606874ed89eb401753b12f532ad46e43ab","observation_id":"82f19ffe-d45d-4e31-85bd-68f6e37ec33f","resolution":{"observed_at":"2026-08-06T17:14:19.340515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2601.00823","last_updated":"2026-04-26T18:34:17Z","snapshot_observed_at":"2026-07-06T22:40:36.452423Z","submitted_at":"2025-12-23T17:33:29Z","title":"Energy-Aware Routing to Large Reasoning Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T20:32:49.030941Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2601.00823"},"observation_digest":"sha256:6a2da39a6ef484608728b3805376e00b1535c16bfebfd095f0c5af472094424b","observation_id":"4d059cc4-2e94-4531-99cd-cdd635e7bd5a","resolution":{"observed_at":"2026-05-16T20:33:24.067155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2603.15042","last_updated":"2026-08-05T05:18:06Z","snapshot_observed_at":"2026-08-08T23:09:22.115133Z","submitted_at":"2026-03-16T09:48:34Z","title":"Determinism-Preserving GPU Spatial Sharing with Vitamin-E","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T10:34:16.525398Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2603.15042"},"observation_digest":"sha256:256313e786beac90c25fdf90c926935ad76415c271e00736b85dd9bcbf1ca7d0","observation_id":"17772232-0efe-498c-bbca-73b5f9903dc5","resolution":{"observed_at":"2026-05-15T10:35:27.451461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2604.16682","last_updated":"2026-04-17T20:39:25Z","snapshot_observed_at":"2026-07-06T23:03:57.199731Z","submitted_at":"2026-04-17T20:39:25Z","title":"KAIROS: Stateful, Context-Aware Power-Efficient Agentic Inference Serving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T06:58:36.525442Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2604.16682"},"observation_digest":"sha256:8cf2987fc71c76575510b570d3b770ac2f1a32c9fb63746a8f379033b11af85c","observation_id":"4b3fa359-f733-408f-a592-3a99a681350a","resolution":{"observed_at":"2026-05-10T07:01:49.268219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2604.27855","last_updated":"2026-05-01T04:05:40Z","snapshot_observed_at":"2026-08-02T10:34:53.143660Z","submitted_at":"2026-04-30T13:40:26Z","title":"AI Inference as Relocatable Electricity Demand: A Latency-Constrained Energy-Geography Framework","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T06:58:01.164783Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2604.27855"},"observation_digest":"sha256:9bf580cb99d1829d4400db2bae64dc889f920541b12d629283f27f7924c8bf4b","observation_id":"56a3eec0-b810-486d-a4d0-121555eb1b26","resolution":{"observed_at":"2026-05-12T10:16:27.539416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2605.11603","last_updated":"2026-05-12T06:32:31Z","snapshot_observed_at":"2026-07-31T18:10:13.620375Z","submitted_at":"2026-05-12T06:32:31Z","title":"GAR: Carbon-Aware Routing for LLM Inference via Constrained Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T01:39:49.694445Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2605.11603"},"observation_digest":"sha256:04c7e485e7b009dc2d567f1bb3f452b1842176f154cfc91ba7a44c6bae6c6a40","observation_id":"3a610215-e230-4df3-94fb-89a2abfccace","resolution":{"observed_at":"2026-05-13T01:42:03.824803Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2605.27309","last_updated":"2026-05-26T17:19:07Z","snapshot_observed_at":"2026-08-02T05:46:41.651451Z","submitted_at":"2026-05-26T17:19:07Z","title":"Greening AI Inference with Accuracy and Latency-aware User Incentives","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T19:03:19.681396Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2605.27309"},"observation_digest":"sha256:d603afc6ab985482710dde13fdf1974da036b7314c26a087aa591320a9b191a4","observation_id":"7add184a-0b97-44e2-a689-9a212e1b5ab1","resolution":{"observed_at":"2026-06-29T19:03:51.120052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2606.07632","last_updated":"2026-05-31T05:58:12Z","snapshot_observed_at":"2026-08-07T18:32:05.914142Z","submitted_at":"2026-05-31T05:58:12Z","title":"Evaluation of ML Resource Utilization Requires Model Life Cycle Assessment","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-28T17:27:19.467192Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2606.07632"},"observation_digest":"sha256:35708d8928de625f364cc5cdb8994eb5d4357cf6d574882b5f990be22c8c5560","observation_id":"0e97ce1d-504d-45a5-a563-baa7ac002d77","resolution":{"observed_at":"2026-07-01T21:06:14.616536Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":"2502.05043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-07-04T02:29:23.910827Z","title":"EcoServe: Designing carbon-aware AI inference systems","venue":null,"work_id":"9e5879c6-c32d-4246-8ab9-a98ebd72b36b","year":2025},"citing_paper":{"arxiv_id":"2606.18851","last_updated":"2026-06-17T09:31:45Z","snapshot_observed_at":"2026-08-06T23:47:31.717047Z","submitted_at":"2026-06-17T09:31:45Z","title":"From Tokens to Energy Flexibility: Quantization-Enabled Demand Response for Data Centers with LLM Inference Workloads","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T19:40:57.370452Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2606.18851"},"observation_digest":"sha256:58bd7fe17876b5d0427e03b6c49395d5e9bcee17559ee199f514156baf90cd49","observation_id":"1e29a8b2-ef1e-477e-bdff-e3c98be45dd3","resolution":{"observed_at":"2026-07-04T02:29:23.912557Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-08-01T20:57:21.540286Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16473","last_updated":"2026-07-17T19:40:38Z","snapshot_observed_at":"2026-08-08T02:47:48.536764Z","submitted_at":"2026-07-17T19:40:38Z","title":"Enabling Spatially Fine-Grained DVFS in Neural Processing Units for Energy-Efficient LLM Serving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T20:57:21.540286Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2607.16473"},"observation_digest":"sha256:a585d838fb037028461459747bde01e2ea39dbc641d94a0f61ba2cd892071c7f","observation_id":"3df9d850-6d9c-429a-bdf5-608747014a6b","resolution":{"observed_at":"2026-08-01T20:57:21.540286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-08-07T13:00:30.958563Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06188","last_updated":"2026-08-06T15:46:18Z","snapshot_observed_at":"2026-08-09T06:14:09.356556Z","submitted_at":"2026-08-06T15:46:18Z","title":"Routing LLM Inference to the Cleanest Grid in Real Time","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:30.958563Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2608.06188"},"observation_digest":"sha256:d3034b0eed3f2c75bbff1028f0544eaeebba1810fe958bbfc4e1233d0eb1a569","observation_id":"c58e9d3b-f534-4daf-afa9-1372a189abb5","resolution":{"observed_at":"2026-08-07T13:00:30.958563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05043","snapshot_observed_at":"2026-08-07T13:00:31.049555Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06188","last_updated":"2026-08-06T15:46:18Z","snapshot_observed_at":"2026-08-09T06:14:09.356556Z","submitted_at":"2026-08-06T15:46:18Z","title":"Routing LLM Inference to the Cleanest Grid in Real Time","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:31.049555Z"},"links":{"cited_paper":"/paper/2502.05043","citing_paper":"/paper/2608.06188"},"observation_digest":"sha256:b5851c6743c367cb572e15629049d2ec63ab0f0b60ae71cacbbcf48556f56400","observation_id":"bb7ba158-1ba9-450c-8a7b-44929659aa1d","resolution":{"observed_at":"2026-08-07T13:00:31.049555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05043/citation-record","integrity":"/paper/2502.05043/integrity","json":"/paper/2502.05043/citation-record.json","paper":"/paper/2502.05043"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.568020Z","title":"https:// lambdalabs.com/service/gpu-cloud","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.568020Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:fdc7f7c054221e4f10dbccad92315825d7b0d32e822bf9bd5dc5d253b62efb92","observation_id":"b9fc4737-f092-4758-ae2b-a62df3c92291","resolution":{"observed_at":"2026-08-08T20:31:35.568020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.572073Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.572073Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:67647106b59dfc15f96992fa8227c6254992bb2caf6da3ed15f063e045b3471d","observation_id":"2c2888aa-75a9-44ab-ab57-fc99bfda0c0c","resolution":{"observed_at":"2026-08-08T20:31:35.572073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.575843Z","title":"https://news.skhynix.com/hbm2e- opens-the-era-of-ultra-speed-memory-semiconductors/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.575843Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:19384266f6bcee39ec0375f086d3d29abf9cee38245c3524c21f4bc8342809c8","observation_id":"7f39646b-6e08-497a-9a1c-e20635c7a3ed","resolution":{"observed_at":"2026-08-08T20:31:35.575843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.579381Z","title":"[Available Online] https://developer.nvidia.com/tensorrt/, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.579381Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d71b04d4e1cac30825e864cee0d352ad082d430e811c3b3d64427fdea988f55a","observation_id":"3657a43a-1562-4dda-8912-7eea37efdd80","resolution":{"observed_at":"2026-08-08T20:31:35.579381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.582814Z","title":"Carbon explorer: A holis- tic framework for designing carbon aware datacenters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.582814Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:935f79eab82ae3c0321355af71f0e3b4999a27f8f873d7f7b6e666c6f5e1b20e","observation_id":"5dc2b9d4-5324-4475-8bc8-f7f508d5946f","resolution":{"observed_at":"2026-08-08T20:31:35.582814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02310","last_updated":"2024-06-17T21:10:46Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:47:08Z","title":"Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02310","snapshot_observed_at":"2026-08-08T20:31:35.586278Z","title":"Taming throughput-latency tradeoff in llm inference with sarathi-serve","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.586278Z"},"links":{"cited_paper":"/paper/2403.02310","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:40d1437f574190576c7982a77fbdef877eaebd9d25045a640aaa82ac5ca2592b","observation_id":"e7f4eaf5-f73f-49ec-bc5c-55264a0a7e01","resolution":{"observed_at":"2026-08-08T20:31:35.586278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.590178Z","title":"Deepspeed- inference: Enabling efficient inference of trans- former models at unprecedented scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.590178Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:91c2172329cf4090442d25fe30470f440167202abd6565ca4f5fd1ff6d9662d9","observation_id":"3af02b93-21e5-451e-8782-277fa6ee575c","resolution":{"observed_at":"2026-08-08T20:31:35.590178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.593951Z","title":"Aws recommended gpu instances, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.593951Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:72426cad966721acfaa685178546e3ddbb1f1f91995c3d014ff6c5b3a0b4db60","observation_id":"305c4472-2da1-4e35-872b-f99e6b85bcee","resolution":{"observed_at":"2026-08-08T20:31:35.593951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.597303Z","title":"Azure gpu optimized virtual machine sizes, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.597303Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:66946d25069466d2d57129e63132a59488693dea56ce7a2bf4de69e4f27a5c50","observation_id":"2227d5ea-65a4-47a1-b9c8-d1ead4542a3e","resolution":{"observed_at":"2026-08-08T20:31:35.597303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.600698Z","title":"Life cycle assessment – dell r740","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.600698Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:680e87b3f614689f771fe98e2214e7ac356868b9f791c3684302286018857709","observation_id":"5cc6b4d6-a16e-430e-9f7c-9bc52a81b52d","resolution":{"observed_at":"2026-08-08T20:31:35.600698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.604161Z","title":"Flashdecoding: Accelerating llm inference by paralleling token generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.604161Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:1d8f1f77463dc824a935a1344a8fe621378ef0eb2010410cb263acb92128fe29","observation_id":"7edb045d-78cb-4fdb-be57-7449823055a1","resolution":{"observed_at":"2026-08-08T20:31:35.604161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.877744Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":"19866f58-3488-4828-a2f8-c07ac041d3be","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.607560Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:59bfeb6db21b2529e8bb0a30c76ee896d893bac98625842aac91d9da3a7ee849","observation_id":"95fc0834-bbe9-4e35-8928-bfd93035251e","resolution":{"observed_at":"2026-08-08T20:31:36.881262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.867194Z","title":"Sharegpt: A dataset of multi-turn chat interactions with large language models","venue":null,"work_id":"5e95cab7-cf6a-491e-85a3-55d2b0bb101c","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.610947Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:45fec66e950ae4293578f0ff7b521ee33b67820fff6ad9f48eceae6bf70e2d0a","observation_id":"a2bd32e2-e792-4e93-9b7f-dbc305d67b33","resolution":{"observed_at":"2026-08-08T20:31:36.870842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.856371Z","title":"Clipper: A{Low-Latency} online prediction serving system","venue":null,"work_id":"8a047d4f-11ee-42e3-9997-0d130c741ed9","year":2017},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.614178Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:a9e38547ed3eddff27c31ecfa4df1792ff124eedfed1fdee851447a96f09fcb1","observation_id":"39171c62-d14f-4745-bd0e-139e45d950ee","resolution":{"observed_at":"2026-08-08T20:31:36.860115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-08T20:31:35.617893Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.617893Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:9c02126be4b898dc302f11bb51d210b605d69a62e4556b981dace03964942ee6","observation_id":"e8dbdfb1-cae4-4f6e-a2cb-3ec77a0e593a","resolution":{"observed_at":"2026-08-08T20:31:35.617893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.621631Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.621631Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:fe30c5c4ec306217885da4d2cc575b00ff728db3507f51709385377faa8565b3","observation_id":"9adbddd2-4015-40b7-a789-66f92dcb3d06","resolution":{"observed_at":"2026-08-08T20:31:35.621631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.840272Z","title":"Hanebutte, Rahul Khanna, and Chris- tian Le","venue":null,"work_id":"3e59bc12-f43d-4874-9037-5720c4daa77f","year":2010},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.624872Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:c71646f748dc68bba2f80a09b59727775c178854e2ae45d0893abce86e982409","observation_id":"a46a3bee-fd2c-4805-a4d0-e7df5eb46da6","resolution":{"observed_at":"2026-08-08T20:31:36.843727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.830218Z","title":"Openblas: An optimized blas library","venue":null,"work_id":"ca439018-be83-4f7f-86d7-2afb4be73f6e","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.628257Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:22323490ae934fa3c1de28ef900dc5f35088ad93d66d5b1ee7c7d01baee3b766","observation_id":"3e3f3c86-b515-456e-980c-dd31240fe1e2","resolution":{"observed_at":"2026-08-08T20:31:36.833547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.820313Z","title":"Cvxpy: A python-embedded modeling language for convex optimization, 2024","venue":null,"work_id":"1e32556f-34e6-49da-a16e-e13b5c4be15b","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.631895Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:8dd64179b6eb7ecf7c6053414887ce403af8bea1189d86427217ce976684b8c6","observation_id":"2b573dc4-c098-41e3-9e25-c72e20fc0613","resolution":{"observed_at":"2026-08-08T20:31:36.823825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18859","last_updated":"2024-05-17T23:33:23Z","snapshot_observed_at":"2026-07-06T16:40:00.062668Z","submitted_at":"2023-10-29T01:08:55Z","title":"SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18859","snapshot_observed_at":"2026-08-08T20:31:35.635288Z","title":"Sida: Sparsity-inspired data-aware serving for efficient and scalable large mixture-of-experts models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.635288Z"},"links":{"cited_paper":"/paper/2310.18859","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:bd9c2b8e123d1e722dcac90e20b75f628f75b0ec34a60d2ff79ba13d2b3a6662","observation_id":"ab2e0b0b-f223-402b-8100-13aa032e80fe","resolution":{"observed_at":"2026-08-08T20:31:35.635288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.809907Z","title":"Focal: A first-order carbon model to assess processor sustain- ability","venue":null,"work_id":"c04a501c-b764-413b-86bb-1efd16215049","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.639319Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:dcac4fb50cb7d3fa074253c0cafa31278cc301bb2a2d727512c4877d248b3186","observation_id":"ce0702e5-ca18-46b9-9953-46291e4cb772","resolution":{"observed_at":"2026-08-08T20:31:36.813890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.799115Z","title":"72-hour hourly map","venue":null,"work_id":"c0fcb5b1-8886-4670-b099-79a3f3989ec6","year":2025},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.642707Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:f09793a430594fb9690d561b382597861fcac4a66de645290138869fc085a0e6","observation_id":"e6544a4e-09c1-42c3-9cda-bafa56a25dae","resolution":{"observed_at":"2026-08-08T20:31:36.802522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14393","last_updated":"2024-01-19T17:33:44Z","snapshot_observed_at":"2026-07-06T16:23:30.533693Z","submitted_at":"2023-09-25T14:50:04Z","title":"LLMCarbon: Modeling the end-to-end Carbon Footprint of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14393","snapshot_observed_at":"2026-08-08T20:31:35.646240Z","title":"Llmcarbon: Modeling the end-to-end carbon footprint of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.646240Z"},"links":{"cited_paper":"/paper/2309.14393","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:cabac852046804949a012494cec90fa059be3545f0b0a9fce3b1629d2dc01244","observation_id":"f2242299-863c-4b8f-b325-9094d10aaffa","resolution":{"observed_at":"2026-08-08T20:31:35.646240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.788388Z","title":"Mobius: Fine tuning large-scale models on commodity gpu servers","venue":null,"work_id":"574cb7c4-a92c-4b39-8fda-b7239d3ca2d7","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.649544Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:42e0fc26257ddfb3de8c1fa56a9e3387ce9f85f788350b1f8184b3a0450acb65","observation_id":"adb58592-0801-43ad-b21b-0ea8cd9737ce","resolution":{"observed_at":"2026-08-08T20:31:36.792093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.777775Z","title":"Garcia Bardon, P","venue":null,"work_id":"ec17863a-e080-4c61-b22e-35e4896c0fcc","year":2020},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.652459Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:5321fc40b7b162a90eda818ff1df07d7dd057ff707200541558b101fb5551ec6","observation_id":"73aa6d10-915c-42ec-a706-a0033c33c2f0","resolution":{"observed_at":"2026-08-08T20:31:36.781246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.767552Z","title":"Llama.cpp: Inference of llama models in pure c/c++","venue":null,"work_id":"8f520dd3-e800-4c1a-8c2e-ea20a0886508","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.655462Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:b5ccad8874f334942f4a167d41942fd0ee8d5d04c248302f3fa66e3f1522f67d","observation_id":"067bb4a1-6eae-4193-a57f-111198d45674","resolution":{"observed_at":"2026-08-08T20:31:36.771087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.757019Z","title":"Gemma.cpp: Efficient inference for large language models","venue":null,"work_id":"d7274c3b-14bb-44be-8fa7-ec3914a4e6b2","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.658759Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:2bbcef46be7405e557b02b8b114de6e303c1ac738b8ef74eb33a7c033a4df054","observation_id":"cd79462a-24d6-49cd-a076-e2151a0b4ca9","resolution":{"observed_at":"2026-08-08T20:31:36.760539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.746661Z","title":"Google sustainability report, 2024","venue":null,"work_id":"73cfdc41-896b-44f4-90d8-62d1acfdfab4","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.661698Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d79bbec8a9497c0d9b9647db2375875212d801a642bd3f147fbe1f544673b5b2","observation_id":"fde478b0-776f-4412-a3d8-f1815186f09e","resolution":{"observed_at":"2026-08-08T20:31:36.750135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.735973Z","title":"Mélange: Cost efficient large language model serving by exploiting gpu heterogeneity, 2024","venue":null,"work_id":"87ddad0b-f91b-4cb6-9e03-80b7dc4a0701","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.664649Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d5cb54731a1138f09912b3c861b5b78271ef9d25d6e6fca7e969aa7af3cdc4f8","observation_id":"5f6b608b-05ca-4a69-9909-3c2256aa59ec","resolution":{"observed_at":"2026-08-08T20:31:36.739587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.725495Z","title":"Serving{DNNs} like clockwork: Performance predictability from the bottom up","venue":null,"work_id":"8308127d-22fd-4d14-aabf-05535ab905f7","year":2020},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.667577Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:25d1330b184a31ccdedc6d45754432d9fa8d6ca72c459b3abea52852bc3c197b","observation_id":"00f4c459-a11b-4644-9d74-10e6b42f9d7f","resolution":{"observed_at":"2026-08-08T20:31:36.729259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.714615Z","title":"Lee, David Brooks, and Carole-Jean Wu","venue":null,"work_id":"12a1f53f-5249-473e-acd5-98c1763dba28","year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.670252Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d4f614b7abafe2767ab6e4e99eb3b3dd204456443ffff5806009629dab6ad8f6","observation_id":"f8f17fb8-5cdf-40c6-b16e-7c8f868b1976","resolution":{"observed_at":"2026-08-08T20:31:36.718440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.703484Z","title":"Chasing carbon: The elusive environmental footprint of computing","venue":null,"work_id":"cd737217-fe7d-41a8-9b75-7af098968092","year":2021},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.673124Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:98adf44c5c66b2411bdfd9a2463dde333da7c8369e88d91bff0735cd356d382d","observation_id":"36b74b4d-7542-4ff4-952c-cc0ff41b5fc2","resolution":{"observed_at":"2026-08-08T20:31:36.707146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-06T20:15:05.193939Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-08T20:31:35.676302Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.676302Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:fc47ab7c4c622d90f79e9fdc96fd5bc5b8c37248cdb68c0f6c3b008f0e181bd1","observation_id":"610edb82-c357-4d9a-9513-9c86109dd002","resolution":{"observed_at":"2026-08-08T20:31:35.676302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01282","last_updated":"2024-01-05T12:41:13Z","snapshot_observed_at":"2026-07-06T16:42:12.176043Z","submitted_at":"2023-11-02T14:57:03Z","title":"FlashDecoding++: Faster Large Language Model Inference on GPUs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01282","snapshot_observed_at":"2026-08-08T20:31:35.679828Z","title":"Flashdecoding++: Faster large language model inference on gpus","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.679828Z"},"links":{"cited_paper":"/paper/2311.01282","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:80283ccca8396bfd176046bf21976d3721820c45ed28c42029f56f7cbcb2c03f","observation_id":"751b4ea8-832f-4923-9adf-d3417765cea8","resolution":{"observed_at":"2026-08-08T20:31:35.679828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06182","last_updated":"2023-06-18T01:33:19Z","snapshot_observed_at":"2026-07-06T15:01:30.019542Z","submitted_at":"2023-03-10T19:30:15Z","title":"Towards MoE Deployment: Mitigating Inefficiencies in Mixture-of-Expert (MoE) Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06182","snapshot_observed_at":"2026-08-08T20:31:35.683723Z","title":"Lee, Anjali Sridhar, Shruti Bhosale, Carole-Jean Wu, and Benjamin Lee","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.683723Z"},"links":{"cited_paper":"/paper/2303.06182","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:17f1b722ee44e1788a1142f4e10f2fec3b4dd5adcdf415fcd22b1d40af0f4da8","observation_id":"0025a02f-5df8-4de8-9066-4e569bdd6a9d","resolution":{"observed_at":"2026-08-08T20:31:35.683723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04976","last_updated":"2026-05-26T00:40:35Z","snapshot_observed_at":"2026-07-06T17:41:23.460300Z","submitted_at":"2024-03-08T01:16:26Z","title":"Advancing Environmental Sustainability in Data Centers via Carbon Depreciation Models","version":4},"cited_work":{"arxiv_id":"2403.04976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.04976","snapshot_observed_at":"2026-08-08T20:31:36.219525Z","title":"Advancing Environmental Sustainability in Data Centers via Carbon Depreciation Models","venue":"cs.DC","work_id":"850834d6-e4e6-4e20-b714-f9e7af8a8d03","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.687251Z"},"links":{"cited_paper":"/paper/2403.04976","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:99deaac24d291c446ce311dbda1e012480e66dbe484dc4578514f13326fb4aaf","observation_id":"fbe5a570-dd2a-448a-b83b-1ae4e935f5ec","resolution":{"observed_at":"2026-08-08T20:31:36.225397Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.692598Z","title":"Neo: Saving gpu memory crisis with cpu offloading for online llm inference, 2024","venue":null,"work_id":"a2d05042-7115-4b97-9485-f0a7e4ce4c4b","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.690723Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:b01172d0f7f234b8ca7d4416fd46eea13172ed50c5b91db4e5affd4f0aeaa047","observation_id":"b9597ea9-18a4-4ec5-b006-86d5a145ddc2","resolution":{"observed_at":"2026-08-08T20:31:36.696254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.682804Z","title":null,"venue":null,"work_id":"36c939c6-3dc3-4727-ab54-c92eb7037da4","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.693726Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:c238c9b0e6888bb111a80f15fed4aa477d112fc306da975a69a12f5461e89a41","observation_id":"5776d0c1-1295-4286-a96e-2d956b559ecb","resolution":{"observed_at":"2026-08-08T20:31:36.686179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.672831Z","title":"Profiling a warehouse-scale computer","venue":null,"work_id":"9037cf25-2789-4a33-8608-0835d1255a03","year":2015},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.697328Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:a5fbc1c2a77d876fc37588073a56d19f8f853f055830b3d43f121d6ca0e34e06","observation_id":"6eda6d94-b0bf-4a8d-87fd-0bc9d75d1e12","resolution":{"observed_at":"2026-08-08T20:31:36.676275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.661960Z","title":"Backblaze hard drive stats for q2 2021, 2021","venue":null,"work_id":"aadc17ef-8905-4d9d-8134-bf68dae070d6","year":2021},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.700665Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:b86a07ee0f4d6d534963bdbd256c5fe1613aa882ff76f17b6a575eadcca03b58","observation_id":"40e33f3d-bfc6-475e-9e54-5f7fcd879ed8","resolution":{"observed_at":"2026-08-08T20:31:36.665706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15030","last_updated":"2024-05-29T08:25:03Z","snapshot_observed_at":"2026-08-06T12:44:13.816721Z","submitted_at":"2023-08-29T05:25:21Z","title":"SwapMoE: Serving Off-the-shelf MoE-based Large Language Models with Tunable Memory Budget","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15030","snapshot_observed_at":"2026-08-08T20:31:35.704164Z","title":"Serving MoE Models on Resource-constrained Edge Devices via Dynamic Expert Swapping, August 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.704164Z"},"links":{"cited_paper":"/paper/2308.15030","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:5fd6486bd08cf2f460495360296bafdfdfb6e50431a50c6c8a66843f3a1d399d","observation_id":"019e539f-2c11-4e2e-9ee7-ebebf948bffa","resolution":{"observed_at":"2026-08-08T20:31:35.704164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.707748Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.707748Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:21bcaa8aaab07cfbce0ce9dd5bc9eda8c9a2d6c48ecc98ffb62063cca13faba5","observation_id":"295bcb9b-a876-4604-a33f-6bf74895da59","resolution":{"observed_at":"2026-08-08T20:31:35.707748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.645424Z","title":"Amp: Automatically finding model parallel strategies with heterogeneity awareness","venue":null,"work_id":"7a37984b-0a8d-4892-8eeb-c06ea00aafd0","year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.711365Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:0bc33bf15d36206c52e4611cd0694acec3facaed5541be9656bd045442bf4c8b","observation_id":"468dabca-80cc-4328-b0bf-230cd1c1809a","resolution":{"observed_at":"2026-08-08T20:31:36.649233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.635542Z","title":"In 17th USENIX Symposium on Operating Systems Design and Implementation (OSDI 23) , pages 663–679, 2023","venue":null,"work_id":"2b16f336-fd72-4bb5-8a30-28c898dce2e2","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.714761Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:4b3b2c5aaad74d259e2c75b515c1762270c502927ccea220f183678f8759624b","observation_id":"a92e2b86-aa29-4a67-8967-2a0a95295477","resolution":{"observed_at":"2026-08-08T20:31:36.639086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.625404Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"7b6c979f-2fa5-4a30-b4db-b27fde2e3a8f","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.717932Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:abe0f022e0e2251f0450d52176a630a6e08dc9e10621505edf98514d12e7c5d8","observation_id":"8628e28a-10eb-4f35-80b7-dd3367e0d92a","resolution":{"observed_at":"2026-08-08T20:31:36.628983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.615007Z","title":"New insight into the aging induced retention time degraded of advanced dram technology","venue":null,"work_id":"8e6cb01a-5bc5-413c-ae44-79c664248bc4","year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.721410Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:cdcc9d4f2a456a17339f2c1d40dc8f29d18870b80acc6fceeddd3744bded73f1","observation_id":"240064bb-ea63-46c5-8375-1b6fd1c28a61","resolution":{"observed_at":"2026-08-08T20:31:36.618564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.604807Z","title":"Cachegen: Kv cache compression and streaming for fast large language model serving","venue":null,"work_id":"31097b79-aa0f-4b35-b208-fe3be05d9481","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.724681Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:fc593ac45db531629eb2aa8b1de4c2600b57938c553b4f518e68166a964ced8e","observation_id":"07360025-7e79-45e6-b153-e9bbcfe121c3","resolution":{"observed_at":"2026-08-08T20:31:36.608388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.594935Z","title":"Longbench: A bilingual long-context benchmark for large language models","venue":null,"work_id":"8532ede5-a75d-4ee7-9019-1115ba144b02","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.727931Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:9865bde560a1b523ddb47a7f3a5ce55a7c6b83e6abb43dcd5c86725af79c742a","observation_id":"9e9ab4bf-a637-421e-990e-bdd2d023e5a3","resolution":{"observed_at":"2026-08-08T20:31:36.598434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.585526Z","title":"Deja vu: Contextual sparsity for efficient LLMs at inference time","venue":null,"work_id":"b81f7e91-6e2b-4aac-b5db-5762065e3831","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.731177Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:e648bfd7679ca1d3584dcc5a7ae06057cfe599156eefedc1d222194344f2bbc9","observation_id":"e344bcf9-7758-42e3-90f1-0144a1f91a3f","resolution":{"observed_at":"2026-08-08T20:31:36.588828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.575398Z","title":"Power hungry processing: Watts driving the cost of ai deployment? In The 2024 ACM Conference on Fairness, Accountability, and Transparency, pages 85–99, 2024","venue":null,"work_id":"1f00b866-749a-474b-9481-4f8f8ce51ed8","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.734673Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:307e4ea69f32b262953652a53e5c1f15992296680fb167439df612d3fea463e7","observation_id":"1eef6046-f17d-4944-96b7-23e7c6643792","resolution":{"observed_at":"2026-08-08T20:31:36.579223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01566","last_updated":"2025-03-05T20:00:57Z","snapshot_observed_at":"2026-08-01T21:33:05.315458Z","submitted_at":"2024-06-03T17:47:53Z","title":"Helix: Serving Large Language Models over Heterogeneous GPUs and Network via Max-Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01566","snapshot_observed_at":"2026-08-08T20:31:35.738204Z","title":"Helix: Distributed serving of large language models via max- flow on heterogeneous gpus","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.738204Z"},"links":{"cited_paper":"/paper/2406.01566","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:dc9803d9e4e30d7e3a0f05bbe15f041e2e7d0c5fe8a9a54d067ed7a304c4ae7f","observation_id":"e90f9fba-9644-48d7-95b4-e75fe7430ea5","resolution":{"observed_at":"2026-08-08T20:31:35.738204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.565142Z","title":"A large-scale study of flash memory failures in the field","venue":null,"work_id":"71ab23d9-830a-42e9-99dc-6c9e0cc6c64b","year":2015},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.741655Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:74a674d20337dc00c399919159b516824f3a892d466dacbc836aa54f6287d5ca","observation_id":"86ed8b63-980f-4fcd-8758-39f0b6f20705","resolution":{"observed_at":"2026-08-08T20:31:36.568895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.555137Z","title":"Microsoft sustainability report, 2024","venue":null,"work_id":"9503ef6c-d5d9-4132-9487-7a726d64bc3b","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.744784Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:fdf17d9c82b6bda04a09e77dee9c10307bcfee2de88f26c59e9c90bfca7de0e2","observation_id":"2c5958a6-6bfd-415b-b8a3-32a6ef6603f0","resolution":{"observed_at":"2026-08-08T20:31:36.558568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.545432Z","title":"Azure public dataset","venue":null,"work_id":"c8889828-96df-49bd-a7dd-8bf5836d5d63","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.748127Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:9964123b26c2498ae1b118363ea802d02dfa23912b9e56ced14072679b2bd647","observation_id":"2e173302-8bdf-483c-aeeb-ed9988967a96","resolution":{"observed_at":"2026-08-08T20:31:36.548906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.535405Z","title":"Roofline Performance Model - NERSC Documentation — docs.nersc.gov","venue":null,"work_id":"53ea9c5d-09d5-4970-a611-feb7e41ac782","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.751493Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:637d03e3bcf29b19691df2d4dbcaa3415b5fbff3ac42a8f8358d712b87091fc2","observation_id":"326b835c-122a-4966-9fe3-68fe2b7a08a0","resolution":{"observed_at":"2026-08-08T20:31:36.538998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.525598Z","title":"Nvml api reference, 2024","venue":null,"work_id":"faa85a2d-5830-4c8a-8ced-cfda38c3f975","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.754685Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:409606a6ce0d1e470edb3af6a0e50f5c353f7a30e7fbe99a3ee8981b64c7cd3a","observation_id":"766bd0cc-675a-44ba-8f72-9d96cc0dfba9","resolution":{"observed_at":"2026-08-08T20:31:36.529052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.515229Z","title":"Deep learning performance guide: Matrix multiplication (gemm)","venue":null,"work_id":"43bfefba-24ae-4579-b97f-289d666e70bb","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.758064Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:0d7b2ecc416a255a969d689892880c04135d9ae26460b78e5cf144d5f04960e7","observation_id":"83cf973d-a198-4d38-98e2-1542321fb3be","resolution":{"observed_at":"2026-08-08T20:31:36.518833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.504731Z","title":"onednn: Deep neural network library","venue":null,"work_id":"9cea5c61-7240-4c1d-b03c-091dc492ea35","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.761455Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d5c4cb33c6301fcb8d397e2e8a64a8d4434cbfd0ed23ae0e43631edc4916463e","observation_id":"8b74c7f6-5b99-4fbf-8864-1449e822c105","resolution":{"observed_at":"2026-08-08T20:31:36.508252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04992","last_updated":"2024-09-08T06:06:44Z","snapshot_observed_at":"2026-08-03T16:41:00.102590Z","submitted_at":"2024-09-08T06:06:44Z","title":"InstInfer: In-Storage Attention Offloading for Cost-Effective Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04992","snapshot_observed_at":"2026-08-08T20:31:35.764869Z","title":"Instinfer: In-Storage Attention Offloading for Cost-Effective Long-Context LLM Inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.764869Z"},"links":{"cited_paper":"/paper/2409.04992","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:ac79754e3af174291b7be4f96cf185cc4e1b24de823e31a3c211658146ddaf87","observation_id":"940d4e1a-e674-4ce5-98c6-13fe7583d90b","resolution":{"observed_at":"2026-08-08T20:31:35.764869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-08-06T12:06:11.068182Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-08-08T20:31:35.768398Z","title":"Splitwise: Efficient generative llm inference using phase splitting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.768398Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:eeb4f9c31105e47d0b6d32d49dcf34e914e3d45e9b8fd01e6bba70752df0ef45","observation_id":"31dba348-38de-492c-90d9-29648527d876","resolution":{"observed_at":"2026-08-08T20:31:35.768398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.494744Z","title":null,"venue":null,"work_id":"c3340316-a61c-4028-b8fb-6e4cdbae8274","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.771591Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:6f3a79ad2d0a5b3d53a0e56b4590a0acd70474a1df292b6801faf605081271cd","observation_id":"9ab383a2-8481-4eed-8da1-07fc6111e0be","resolution":{"observed_at":"2026-08-08T20:31:36.498296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.484805Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":"4ab6497d-edf6-4146-b4fd-bf18b6086a51","year":2020},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.774470Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:1e02af624a06bf28ca952221370df14c6c6d12f7987f5aa374498494b48c5163","observation_id":"89ba1b1c-7f17-4e2c-a4ef-7fc51a53acba","resolution":{"observed_at":"2026-08-08T20:31:36.488537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.474784Z","title":"Xnnpack: High-performance neural network inference frame- work","venue":null,"work_id":"952d5c3b-804d-48d3-8842-8d0698edc367","year":2020},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.777723Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:f8a37fad74ed0bc5e0a72462255a1572c2e4a6b4ec28422234aedfb10024f199","observation_id":"7448a11e-d57d-4c2d-b208-fb77891febff","resolution":{"observed_at":"2026-08-08T20:31:36.478285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.465202Z","title":"{INFaaS}: Automated model-less inference serving","venue":null,"work_id":"f37e9c63-d61b-49a8-80de-6c8cd629c392","year":2021},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.780817Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:15c6ef02c10a499cb35b8bc6205857987e47897d5ac4b9a7e6a7bc35f649a3b6","observation_id":"326522fc-a0a5-4117-8891-c16707078f12","resolution":{"observed_at":"2026-08-08T20:31:36.468500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-08T20:31:35.783763Z","title":"Bloom: A 176b-parameter open-access multilingual language model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.783763Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:9da179c7a7976f16a35a026b44bb6410ab27fcd13ee36847717e69b340f3fc20","observation_id":"1497fdb9-8396-45d2-a854-6379701e9b70","resolution":{"observed_at":"2026-08-08T20:31:35.783763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01671","last_updated":"2025-02-01T17:26:19Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-02-01T17:26:19Z","title":"Life-Cycle Emissions of AI Hardware: A Cradle-To-Grave Approach and Generational Trends","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01671","snapshot_observed_at":"2026-08-08T20:31:35.787230Z","title":"Life-cycle emissions of ai hardware: A cradle-to-grave approach and generational trends","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.787230Z"},"links":{"cited_paper":"/paper/2502.01671","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d07743fb82bda2c90ccb6f9be26c737afdad648d0be330910a103f732ae69f2f","observation_id":"3d29ce01-5d38-4f99-aed5-f4e5d6c8ce6a","resolution":{"observed_at":"2026-08-08T20:31:35.787230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.454938Z","title":"Data center lifecycle co2e calculator, 2024","venue":null,"work_id":"45ae258b-77e8-4568-8889-d3c43739f3fa","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.791094Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:2dbb8e54cb6f26dcd0d09c1b1a597404d35a31f48a6317ecaa828849da04d76c","observation_id":"46c1cab4-3d80-42a1-8296-c12421d4113c","resolution":{"observed_at":"2026-08-08T20:31:36.458228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.445781Z","title":null,"venue":null,"work_id":"d37e688f-13b7-445b-87b8-0aaeda60b54c","year":2007},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.794338Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:543956bf15f3f4d176b453893fecdefe52ff8efc4d97ed9245eca813e279a2e5","observation_id":"aa6744af-cfdd-4370-a6a3-b54261dee034","resolution":{"observed_at":"2026-08-08T20:31:36.448776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.436030Z","title":"Flash reliability in production: The expected and the unexpected","venue":null,"work_id":"93b975e4-d91c-4499-b3a4-1c98305ce5cd","year":2016},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.797459Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:1fa4d6d9217a0c6e6eb70961a9ef64106aa0b3aa6196e3acda476013854fe9f3","observation_id":"2ddbbc4e-a50a-4c94-8f22-baab846210a6","resolution":{"observed_at":"2026-08-08T20:31:36.439324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.425615Z","title":"FlexGen: High- Throughput Generative Inference of Large Language Models with a Single GPU","venue":null,"work_id":"251b1ca5-f56f-4a78-8c15-b8f9ddd6fbd3","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.800638Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:5dc16c98eed7e768dfb938afded8eec5048fdb41134eeb442088689a95c6db38","observation_id":"d44a77b1-4324-4a47-a29a-fb4912d300d1","resolution":{"observed_at":"2026-08-08T20:31:36.429312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.415063Z","title":"Lifetime memory reliability data from the field, 2017","venue":null,"work_id":"4dae2b0f-c081-45b5-ac61-8cb1815383c0","year":2017},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.803889Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:b23c60d24d693edad4a7c9ee3361f181832a27d5fa576a2fdfbbb5eb594a13cb","observation_id":"f8872713-1d1d-4a1c-9467-526027e0dc18","resolution":{"observed_at":"2026-08-08T20:31:36.418678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12456","last_updated":"2024-12-12T12:38:12Z","snapshot_observed_at":"2026-08-07T20:41:48.188566Z","submitted_at":"2023-12-16T02:27:00Z","title":"PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12456","snapshot_observed_at":"2026-08-08T20:31:35.806995Z","title":"Powerinfer: Fast large lan- guage model serving with a consumer-grade gpu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.806995Z"},"links":{"cited_paper":"/paper/2312.12456","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:982568c96a814b8bffcd4c5fe8f8b68ea0387efa0b5bcaa023e788a913b8cfd0","observation_id":"c8978d1f-3d8f-4ff8-b6ed-06c6ef73bddf","resolution":{"observed_at":"2026-08-08T20:31:35.806995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.810526Z","title":"Dynamollm: Designing llm inference clusters for performance and energy effi- ciency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.810526Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:c12f53b9ec1eabde69ae246caa4318fe5956e8cb13f5f1bea6ac788484ac300f","observation_id":"3f343e95-64d1-48d3-abdf-eb73d1a31f69","resolution":{"observed_at":"2026-08-08T20:31:35.810526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11313","last_updated":"2020-07-13T04:23:41Z","snapshot_observed_at":"2026-08-05T04:37:30.965642Z","submitted_at":"2019-11-26T03:06:26Z","title":"Summarizing CPU and GPU Design Trends with Product Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11313","snapshot_observed_at":"2026-08-08T20:31:35.813779Z","title":"Summarizing cpu and gpu design trends with product data","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.813779Z"},"links":{"cited_paper":"/paper/1911.11313","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:aa6607ff7c7c0f9206205f0f9d4b28fd6a17bb4528f4115ffefcf085ab3db69e","observation_id":"c0a4efb5-8304-4941-a5bb-21f0f7ed3305","resolution":{"observed_at":"2026-08-08T20:31:35.813779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.404016Z","title":null,"venue":null,"work_id":"71810935-c078-42d9-93e4-a17531de22fa","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.817527Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:759fc4ef4262d21b15bb1758c65a313985e42ac2222291874d6f3b7be1d1a006","observation_id":"cd438645-4cef-474d-9dd5-6d29c42177f0","resolution":{"observed_at":"2026-08-08T20:31:36.408125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.392801Z","title":"Accelerating self-attentions for llm serving with flashinfer, 2024","venue":null,"work_id":"f3cc238f-fd27-47e6-8a3a-2314689f0696","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.820950Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d16899a0e92e9bb76dcbe71b41bbe0890f8560f2f6bb1b88f98ae2747a2845df","observation_id":"ae9d4eb2-618a-49c5-af8f-c318fbc6f526","resolution":{"observed_at":"2026-08-08T20:31:36.396403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.381681Z","title":"Micron 1𝛼 dram technology, Nov 2024","venue":null,"work_id":"c9aa33bb-0baa-4195-9980-a458606793d0","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.824208Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:ae2dbb966f54277144cae550c42beba8c97e6b5b8459099aeabb97fb91089569","observation_id":"01203ee5-511f-4a7b-86c4-4be4f6576701","resolution":{"observed_at":"2026-08-08T20:31:36.385251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12032","last_updated":"2025-02-06T04:16:22Z","snapshot_observed_at":"2026-07-06T19:34:10.252984Z","submitted_at":"2024-10-15T20:06:33Z","title":"MLPerf Power: Benchmarking the Energy Efficiency of Machine Learning Systems from Microwatts to Megawatts for Sustainable AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12032","snapshot_observed_at":"2026-08-08T20:31:35.827403Z","title":"Mlperf power: Benchmarking the energy efficiency of machine learning systems from microwatts to megawatts for sustainable ai.arXiv preprint arXiv:2410.12032, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.827403Z"},"links":{"cited_paper":"/paper/2410.12032","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:2bf28abb126e941842e4d0fe6b3228308241d6371c7db3f3637d08b40045581a","observation_id":"51ea54c0-3b57-44f7-9511-bfd34df8ddcd","resolution":{"observed_at":"2026-08-08T20:31:35.827403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.370807Z","title":"vllm v0.6.0: 2.7x throughput improvement and 5x latency reduction, September 2024","venue":null,"work_id":"2b81a937-d23f-40cc-90e9-8227147c6771","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.831195Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:248d858c314ec795e6e5d87e2c07bb4c1f9fe778ea8b0377c3cbdccd4a144c1c","observation_id":"d3c9782a-5cbc-4116-abe1-c1341b4f5def","resolution":{"observed_at":"2026-08-08T20:31:36.374458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.360530Z","title":"Designing cloud servers for lower carbon","venue":null,"work_id":"d6e01d1e-cf28-431b-ab8f-daafb0d8f7e2","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.834787Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:f3a170c578dc480ed0c1cb9c7b28528549ebcdcfb71a0559ec2e5cea59e52763","observation_id":"02341d40-c7d6-432c-a6b2-b55baab3415e","resolution":{"observed_at":"2026-08-08T20:31:36.364131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.349856Z","title":"Coverage map","venue":null,"work_id":"a102a560-6d82-44c1-ba76-1d4384ad305f","year":2025},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.838207Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:5479d2ffac644505c4c9fe6ce91b1ce030607e1bf4335245df11d57ae5526310","observation_id":"e763be3d-bea8-49f9-bcc6-7c81d6a8f9d7","resolution":{"observed_at":"2026-08-08T20:31:36.353608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:35.841692Z","title":"Roofline: an insightful visual performance model for multicore architectures","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.841692Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:ad27eb624246e2a50131554515fa5ee34a3ab789758655c2826f4bec8480f309","observation_id":"ec1cc89c-0474-4ab7-b452-5cd043f29342","resolution":{"observed_at":"2026-08-08T20:31:35.841692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.332761Z","title":"TwinPilots: A New Computing Paradigm for GPU-CPU Parallel LLM Inference","venue":null,"work_id":"c9834afc-a1e7-4366-8cc6-7eabb84e8500","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.845405Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:0a651e0e7f698f6627e324e89cb978a3cb921748464c5fd357c9d0ebbbb58a5b","observation_id":"212090d2-98a2-4f54-ad25-186d776a6d53","resolution":{"observed_at":"2026-08-08T20:31:36.336235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.322298Z","title":"Decentralized training of foundation models in heterogeneous environments, 2022","venue":null,"work_id":"476968b6-4593-4016-aef4-661eecbaae8f","year":2022},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.848656Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:f15728823b06fe1e2439494b92ef18a3079bcda09644ef3c99e2e177ced3a6ed","observation_id":"b8426116-bd26-4bef-a19e-3fb5af3b2c1f","resolution":{"observed_at":"2026-08-08T20:31:36.326026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-08T20:31:35.852245Z","title":"Llm inference unveiled: Survey and roofline model insights","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.852245Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:511cdcc93f86640c8ca118c15befc19b8a1fd0f2f33837966aa71b2ff85c0e68","observation_id":"2164ac5a-ad2a-4c46-afae-d0fb53ae3d2d","resolution":{"observed_at":"2026-08-08T20:31:35.852245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.311299Z","title":"In 20th USENIX Symposium on Networked Systems Design and Implementation (NSDI 23) , pages 787–808, 2023","venue":null,"work_id":"3384d96a-3230-4a9d-9806-fbae96abf85e","year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.855955Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:54be3e66fb05232a6cb43784e57af84f600b3dffbe3ee2c160465a5ec85ec2b0","observation_id":"68fc2333-0dd1-4f00-9df2-3087818363af","resolution":{"observed_at":"2026-08-08T20:31:36.315196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:31:36.300935Z","title":"H2o: Heavy- hitter oracle for efficient generative inference of large language models.Advances in Neural Information Processing Systems , 36, 2024","venue":null,"work_id":"0202302c-6e43-4cc6-9f2c-23639865b206","year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.859556Z"},"links":{"citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:56783fd2598a6700b07abcae4d255133db53847970c7eea58fa1b523dd5004f6","observation_id":"56e64a44-7d99-4188-a2f3-9c4907af8489","resolution":{"observed_at":"2026-08-08T20:31:36.304471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01164","last_updated":"2024-03-02T10:37:21Z","snapshot_observed_at":"2026-07-06T17:38:34.497555Z","submitted_at":"2024-03-02T10:37:21Z","title":"HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01164","snapshot_observed_at":"2026-08-08T20:31:35.863029Z","title":"HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.863029Z"},"links":{"cited_paper":"/paper/2403.01164","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:d0f26a7cff41d14c75d1abe73e0617e6f8c14e4aefa677305d40d29b62a492ee","observation_id":"d679780a-a501-4a46-9f38-09526025853d","resolution":{"observed_at":"2026-08-08T20:31:35.863029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-08T20:31:35.866624Z","title":"Efficiently programming large language models using sglang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.866624Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:9ab700f8317a9b4c3df76c9cc65f0a663fef7f94ad03d19ba06ca2a88d232a76","observation_id":"7934aee2-db3f-49ce-9647-c7611e41c361","resolution":{"observed_at":"2026-08-08T20:31:35.866624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09670","last_updated":"2024-06-06T15:50:51Z","snapshot_observed_at":"2026-08-05T00:28:57.370523Z","submitted_at":"2024-01-18T01:03:38Z","title":"DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09670","snapshot_observed_at":"2026-08-08T20:31:35.870375Z","title":"Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T20:31:35.870375Z"},"links":{"cited_paper":"/paper/2401.09670","citing_paper":"/paper/2502.05043"},"observation_digest":"sha256:18b01888369a75b23049c707f7acb928730d2ada7d571e7b9491501759cc27bc","observation_id":"3c1328f7-20fd-4acd-9987-3864e5efbb80","resolution":{"observed_at":"2026-08-08T20:31:35.870375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05043","last_updated":"2025-03-15T19:26:40Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-08T20:25:22.972731Z","submitted_at":"2025-02-07T16:09:17Z","title":"EcoServe: Designing Carbon-Aware AI Inference Systems"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 14 inbound Pith citation observations for arXiv:2502.05043."}