{"as_of":"2026-08-20T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e82d56e72fbc9733e842a6981665a904364f859c663b65eeb522c22aba7cf60f","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:01:11.474559Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.18556/citation-record","integrity":"/paper/2508.18556/integrity","json":"/paper/2508.18556/citation-record.json","paper":"/paper/2508.18556"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.745274Z","title":"Basaran and K","venue":null,"work_id":"3b8745cf-a637-4590-8a20-bc6957a7921e","year":2012},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.386848Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:cf28facd159dff372c2165ea4a7fb00b95d60e10c50c758ce813d7774fa1a0dd","observation_id":"c3504fab-fa52-4d26-91fb-9641fbdc3e10","resolution":{"observed_at":"2026-08-15T17:01:11.747815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.738134Z","title":"Sheaffer, Sang-Ha Lee, and Kevin Skadron","venue":null,"work_id":"d5e62508-2edc-45ef-a0cb-76dc156f82bb","year":2009},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.391024Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:e3c7c3210db341c38a7436ea5083535b4235fe3f7c24aaed38c047a275628adc","observation_id":"7b444fa6-3a4e-4640-ab06-c09995a47573","resolution":{"observed_at":"2026-08-15T17:01:11.740990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.731064Z","title":"Sheaffer, Michael Boyer, Lukasz G","venue":null,"work_id":"e47cfa3a-4fc8-4485-b4b6-4a9389960d70","year":2010},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.394114Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:ca6469999d0ce0f1e53f8c55b328cbc2a1e75427f5036155ea08559c36d4d3b6","observation_id":"4f5d1196-06ff-47f7-a15a-53d946d4c262","resolution":{"observed_at":"2026-08-15T17:01:11.733648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.723430Z","title":"CASE: a compiler-assisted scheduling framework for multi-gpu systems","venue":null,"work_id":"400178b4-08b9-43a4-ae92-013ce74fa1bc","year":2022},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.396565Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:c724a818c3b997c029b7ef5471e90f6cac58a69fe30ed6bec068e6f86ae821cf","observation_id":"b70b65e9-eeb0-4891-91cc-a4c1eec577a7","resolution":{"observed_at":"2026-08-15T17:01:11.726532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.716188Z","title":"Zhao, Yanping Huang, Andrew M","venue":null,"work_id":"bfd2df13-a90b-4181-9f0c-ba60070e2e1f","year":2024},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.399071Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:666044d89bfae2b84c33a61604f7f7d6e486b5d60ffbb72b08afa4b271db8196","observation_id":"fa049099-a881-45da-873f-ee04d0849c73","resolution":{"observed_at":"2026-08-15T17:01:11.718855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T17:01:11.401482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.401482Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:9e38051a107447be1a5fc03223cb30d21c7a128bc75ccb46ce292432884cbc91","observation_id":"9c24ba7e-4940-476d-a461-00dbaa939d5c","resolution":{"observed_at":"2026-08-15T17:01:11.401482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.709005Z","title":"Estimating GPU memory consumption of deep learning models","venue":null,"work_id":"1ecb7d88-c689-4f2d-8415-ce621263a2f8","year":2020},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.404471Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:a910d9b32135d68ba59606bc4eb87db003be942109be009e1ca5bf327b1c8b25","observation_id":"6d3e4dba-1d96-4da2-8ec4-68795f311e39","resolution":{"observed_at":"2026-08-15T17:01:11.711659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.701775Z","title":"Characterization and prediction of deep learning workloads in large-scale GPU datacenters","venue":null,"work_id":"e38ae28d-ed05-49a0-9af4-d0187fc81c7f","year":2021},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.406728Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:624d974454de807db0c058fb6d4bc78c79d441b7c5729f83f19b98a29a2cd5f0","observation_id":"04a47645-7c46-4e18-93a1-c7699ee41769","resolution":{"observed_at":"2026-08-15T17:01:11.704515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.693534Z","title":"Gdev: First-class GPU resource manage- ment in the operating system","venue":null,"work_id":"d4c88f99-9be0-4799-a708-34b77a612f49","year":2012},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.409164Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:d1ef7643846b9bf55b5e13acce1e3f1151e30cdaa32a33279dbce0daa3dcf0ef","observation_id":"838427d3-99be-4601-af1e-cc51e38380bb","resolution":{"observed_at":"2026-08-15T17:01:11.696431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.685943Z","title":"MISO: exploiting multi- instance GPU capability on multi-tenant GPU clusters","venue":null,"work_id":"23c32011-45fe-4cf0-9846-88364ebc6928","year":2022},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.411570Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:e8b866121cc8e5282bbac41ccbdd493ee71b7056990fdf2c8e2220f4e9cd4b12","observation_id":"fcad5c01-10e7-4e59-991d-5c8f801599f7","resolution":{"observed_at":"2026-08-15T17:01:11.688905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.678291Z","title":"Clover: Toward sustainable AI with carbon- aware machine learning inference service","venue":null,"work_id":"83415eb4-9526-4254-957e-cbc4783d7437","year":2023},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.414257Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:f97ee4f61d8784e9f7e3d9ed50b66490124c0e57229deb040e8cfdc7c8d38ff2","observation_id":"1e0ff1d3-55de-4abf-9d8b-4f078c530b7c","resolution":{"observed_at":"2026-08-15T17:01:11.681492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.670509Z","title":"Zico: Efficient GPU memory sharing for concurrent DNN training","venue":null,"work_id":"7ede0e95-4303-4466-93b2-6ec209c1d4c7","year":2021},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.416532Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:da2e7c815af5431da1fd58e4221aea6e8f18686cf8f25a8ded081b0a915af713","observation_id":"c5734c8f-9169-4a2a-bfd6-4691cd139384","resolution":{"observed_at":"2026-08-15T17:01:11.673650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.663282Z","title":null,"venue":null,"work_id":"3c630627-4460-4867-a812-c681c5b2f886","year":2011},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.418992Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:d7cb335afb28819ddffe9b1815405f84d56c2ca0e0d30db333e09bed36d574cb","observation_id":"aaaa46e7-99d0-4558-a90f-42d3fe231249","resolution":{"observed_at":"2026-08-15T17:01:11.665719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.653583Z","title":"Mig user guide","venue":null,"work_id":"0824dec5-9e15-488c-8c93-90e7bf351d99","year":null},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.422174Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:8d80adc820e1ad061bb6d29ceef25e4015781f5e4b79dedeac80e26b7b381c24","observation_id":"0e4fe565-1f4c-4e5b-a145-52c580896b4d","resolution":{"observed_at":"2026-08-15T17:01:11.657981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.646101Z","title":"Chimera: Collaborative preemption for multitasking on a shared gpu","venue":null,"work_id":"19e21515-2e23-496a-9f64-5370a5101984","year":2015},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.425142Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:2b5d5446bd59004bd64e6db8cbe7b637dcedf12b545fd62c675c3880b7025cdc","observation_id":"230d312f-f51a-469c-83c0-b0cb9f7799d3","resolution":{"observed_at":"2026-08-15T17:01:11.649151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.638566Z","title":"Compiler- assisted scheduling for multi-instance gpus","venue":null,"work_id":"e0ad90f3-653e-423f-87e3-f0ea157e2047","year":2022},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.427669Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:eb862dc9d2c09ae6141a4937250d08f44d7ee99ac9dce8fadef85636b74f3d2d","observation_id":"4c580ef9-0f82-4ff8-82f4-19c58bf9f5cb","resolution":{"observed_at":"2026-08-15T17:01:11.641551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.630985Z","title":"Rossbach, Jon Currey, Mark Silberstein, Baishakhi Ray, and Emmett Witchel","venue":null,"work_id":"3d3cf1f5-6ee1-4ae6-a9ba-03f37c6fc59d","year":2011},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.430067Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:ae871904cfc16ee8f3676a51e5601cdb9cc96c89c78f1a2060b94cafb0eabb79","observation_id":"2930dbc5-eed7-4ab1-9de1-f6e6f1b2c4e1","resolution":{"observed_at":"2026-08-15T17:01:11.633924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.623128Z","title":"A preemption-based runtime to efficiently schedule multi-process applications on heterogeneous clusters with gpus","venue":null,"work_id":"c23d43c2-b830-4639-b9f6-31f3313092e4","year":2013},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.432459Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:5bb058c4d42f3b44a3766c350beb412fa07b91fe94cc042ef0fcc78223ae5039","observation_id":"bb2074df-48b4-458a-9c39-5be6bb05404b","resolution":{"observed_at":"2026-08-15T17:01:11.626248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.615598Z","title":"Samuel, Stephen McNally, and John Wynkoop","venue":null,"work_id":"b1a794cc-1994-408f-8880-3bd125e17694","year":2012},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.437982Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:41add7c97596cc37a7e9be18e7ef873c6f62ea8f8044b7d190305f23b35ae687","observation_id":"2b587bce-d3fe-4f4e-8c31-71f7413e24bb","resolution":{"observed_at":"2026-08-15T17:01:11.618633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.608125Z","title":"Junkyard computing: Repurposing dis- carded smartphones to minimize carbon","venue":null,"work_id":"c62fc02a-eb04-4b63-a4d8-7915cef180c8","year":2023},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.440638Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:acfde8dc7c9d5932cd287d965af2b9ede11298bfcfd4063454a49ea8e85ffb70","observation_id":"8e1d0dbd-b1e2-40db-951c-5a3564d66fe6","resolution":{"observed_at":"2026-08-15T17:01:11.611185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11067","last_updated":"2021-09-18T19:57:13Z","snapshot_observed_at":"2026-08-19T19:33:42.402958Z","submitted_at":"2021-09-18T19:57:13Z","title":"Serving DNN Models with Multi-Instance GPUs: A Case of the Reconfigurable Machine Scheduling Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11067","snapshot_observed_at":"2026-08-15T17:01:11.442960Z","title":"Serving DNN models with multi-instance gpus: A case of the reconfigurable machine scheduling problem","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.442960Z"},"links":{"cited_paper":"/paper/2109.11067","citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:6cdeb18a95163153ea1b5cb5681fb3461366f3a314a6e3361719f9582b5b1b2c","observation_id":"988b1264-4700-4582-a371-e6fdcb4a0a28","resolution":{"observed_at":"2026-08-15T17:01:11.442960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.600714Z","title":"Gpupool: A holistic approach to fine-grained GPU sharing in the cloud","venue":null,"work_id":"38cc9f6c-bd78-4d06-9d28-de87cb63ce89","year":2022},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.445733Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:62db1b5b1cd50292cfe285a2c97c8792ac51937515aa0fe9b47e93f3a3080955","observation_id":"78681217-0c22-4bd1-98dc-945455b6f149","resolution":{"observed_at":"2026-08-15T17:01:11.603549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.592872Z","title":"Tanasic, I","venue":null,"work_id":"ac6f7d37-191c-4c6b-a768-119a50031799","year":2014},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.448236Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:f3ddd543671baebe27ae4a4ed825e02daf99304ba7cccf558aec2ad17c0c57a5","observation_id":"eef68c99-3a5c-4c75-927b-3bf30146556f","resolution":{"observed_at":"2026-08-15T17:01:11.595808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.582904Z","title":"Pcie bandwidth-aware scheduling for multi-instance gpus","venue":null,"work_id":"5bc56f61-2928-4a0a-922b-d2795ff827a6","year":2025},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.450600Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:0bd48823737a296ea7f70629519ec6db73b29f4e7d7197c409a0d8b50b8912da","observation_id":"8810e470-1728-49c5-9833-2c00fcf83b66","resolution":{"observed_at":"2026-08-15T17:01:11.587655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13126","last_updated":"2024-07-18T03:32:53Z","snapshot_observed_at":"2026-08-17T09:46:39.435389Z","submitted_at":"2024-07-18T03:32:53Z","title":"Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13126","snapshot_observed_at":"2026-08-15T17:01:11.452853Z","title":"Improving GPU multi-tenancy through dy- namic multi-instance GPU reconfiguration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.452853Z"},"links":{"cited_paper":"/paper/2407.13126","citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:bb840fe88aea46ec803d91483a0c684b3b31863ac667fd00350ba0f9f4499719","observation_id":"6a933c57-1ad9-486b-8ba4-9d3a08725033","resolution":{"observed_at":"2026-08-15T17:01:11.452853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.574017Z","title":"Mlaas in the wild: Workload analysis and scheduling in large-scale heterogeneous GPU clus- ters","venue":null,"work_id":"603584c8-d1b0-4f04-958b-d3873983fa69","year":2022},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.455674Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:5901d480a2cea785c6a86a129eee67a4ad8258c8ceab4afa971bdcaed04562b8","observation_id":"6c5be05e-e153-430f-8dfc-5f6e16899a11","resolution":{"observed_at":"2026-08-15T17:01:11.578117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.564317Z","title":"Flep: Enabling flexible and efficient preemption on gpus","venue":null,"work_id":"f8c54f6b-1790-40b7-a8d7-b9b113761a6d","year":2017},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.458147Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:c619f1ff0796d5cf244ab4ef54917c60c02377240081ba497953c4341707318b","observation_id":"d7f24c28-0164-4abb-833d-0bdfbf12f9db","resolution":{"observed_at":"2026-08-15T17:01:11.568082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.554153Z","title":"Gandiva: Introspective cluster scheduling for deep learning","venue":null,"work_id":"3b0281a9-7e8a-4081-9cae-eaecf00e20d5","year":null},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.460563Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:97d5be157b9340037816e8de0c6e777befcc9bccbab754efb04eb53c6d29cfd3","observation_id":"920c56ae-7dfa-49bf-b8c8-4ca65fd792c0","resolution":{"observed_at":"2026-08-15T17:01:11.558694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-15T17:01:11.463179Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.463179Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:0225acf2296b9606d4a53338de031ffcdd0f9e91637c21d511f3b258b01655ed","observation_id":"0fb78145-9af8-4e7e-bc06-a92d4ad18b5e","resolution":{"observed_at":"2026-08-15T17:01:11.463179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.545429Z","title":"Towards GPU utilization prediction for cloud deep learning","venue":null,"work_id":"96db763d-2dcd-4a2a-9a07-3d293dd93641","year":2020},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.466545Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:258f4ab12315865f6f068fca95b68acf6ea0524059e1842660d06c0281b9166e","observation_id":"4bf8331c-bc8c-445f-b076-12adf9dfa043","resolution":{"observed_at":"2026-08-15T17:01:11.548984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.537198Z","title":"Young, Jason Riedy, Thomas M","venue":null,"work_id":"8dac5157-860f-4a3b-a105-db0f4d8c9f18","year":2019},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.468898Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:fb96a64edf91389498747a7a6d650f0222df86115adad14f8caa8224ee3dcc7c","observation_id":"1c407144-c540-41c3-a67f-09577b4767b2","resolution":{"observed_at":"2026-08-15T17:01:11.540218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.529477Z","title":null,"venue":null,"work_id":"c6c603a1-dc5d-4461-93ed-c1c8d625b358","year":2015},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.471585Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:19ea5e4c45130075b0e3aa865d71e75e81c8cd28a72728e3590a3bb42bfcfd25","observation_id":"d2826218-ee10-4007-ae4d-66c383927ff1","resolution":{"observed_at":"2026-08-15T17:01:11.532023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:01:11.519181Z","title":"Table 2: The ML mixes used in the experiments","venue":null,"work_id":"f0c294ea-ec4b-408b-b2b3-30790049b889","year":null},"citing_paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:01:11.474559Z"},"links":{"citing_paper":"/paper/2508.18556"},"observation_digest":"sha256:55e699159342395959e46e9d0019d54fd3b6a0a9727a561115cf73715c8bb781","observation_id":"248bc2a2-6615-4430-b5a8-a4d945f4713b","resolution":{"observed_at":"2026-08-15T17:01:11.523993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.18556","last_updated":"2025-08-25T23:15:49Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-17T15:57:39.944889Z","submitted_at":"2025-08-25T23:15:49Z","title":"Managing Multi Instance GPUs for High Throughput and Energy Savings"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.18556."}