{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2026:QDMZQQAD5TF6J7APY5ZEXBHXYW","short_pith_number":"pith:QDMZQQAD","schema_version":"1.0","canonical_sha256":"80d9984003eccbe4fc0fc7724b84f7c581f3b4151d22824a77e879d09f6844da","source":{"kind":"arxiv","id":"2601.20408","version":2},"attestation_state":"computed","paper":{"title":"Meeting SLOs, Slashing Hours: Automated Enterprise LLM Optimization with OptiKIT","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.DC","authors_text":"Antonios Gasteratos, Kareem Eissa, Matteo Nulli, Nicholas Santavas, Patrycja Cieplicka, Piotr Florek, Seyyed Hadi Hashemi, Shahram Khadivi, Stefan Vasilev","submitted_at":"2026-01-28T09:13:17Z","abstract_excerpt":"Enterprise LLM deployment faces a critical scalability challenge: organizations must optimize models systematically to scale AI initiatives within constrained compute budgets, yet the specialized expertise required for manual optimization remains a niche and scarce skillset. This challenge is particularly evident in managing GPU utilization across heterogeneous infrastructure while enabling teams with diverse workloads and limited LLM optimization experience to deploy models efficiently. We present OPTIKIT, a distributed LLM optimization framework that democratizes model compression and tuning"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2601.20408","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","primary_cat":"cs.DC","submitted_at":"2026-01-28T09:13:17Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"76523d4490a1e1a65b907737e5758c908fcee8ff56108adea4863d1868868037","abstract_canon_sha256":"107bf3a779da4a662443be0222eef66e26e6112bcadd4f67ab890f007ed8e7cd"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-06-09T02:07:18.240341Z","signature_b64":"OGEfvtkbff8Vyupslggu148fP+u7ynPq2uTYBahY2tJ5fCDuTtkrqq/jBsCoPFKllQ12/r9JFziXor/hQRmTBw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"80d9984003eccbe4fc0fc7724b84f7c581f3b4151d22824a77e879d09f6844da","last_reissued_at":"2026-06-09T02:07:18.239451Z","signature_status":"signed_v1","first_computed_at":"2026-06-09T02:07:18.239451Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Meeting SLOs, Slashing Hours: Automated Enterprise LLM Optimization with OptiKIT","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.DC","authors_text":"Antonios Gasteratos, Kareem Eissa, Matteo Nulli, Nicholas Santavas, Patrycja Cieplicka, Piotr Florek, Seyyed Hadi Hashemi, Shahram Khadivi, Stefan Vasilev","submitted_at":"2026-01-28T09:13:17Z","abstract_excerpt":"Enterprise LLM deployment faces a critical scalability challenge: organizations must optimize models systematically to scale AI initiatives within constrained compute budgets, yet the specialized expertise required for manual optimization remains a niche and scarce skillset. This challenge is particularly evident in managing GPU utilization across heterogeneous infrastructure while enabling teams with diverse workloads and limited LLM optimization experience to deploy models efficiently. We present OPTIKIT, a distributed LLM optimization framework that democratizes model compression and tuning"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2601.20408","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2601.20408/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2601.20408","created_at":"2026-06-09T02:07:18.239562+00:00"},{"alias_kind":"arxiv_version","alias_value":"2601.20408v2","created_at":"2026-06-09T02:07:18.239562+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2601.20408","created_at":"2026-06-09T02:07:18.239562+00:00"},{"alias_kind":"pith_short_12","alias_value":"QDMZQQAD5TF6","created_at":"2026-06-09T02:07:18.239562+00:00"},{"alias_kind":"pith_short_16","alias_value":"QDMZQQAD5TF6J7AP","created_at":"2026-06-09T02:07:18.239562+00:00"},{"alias_kind":"pith_short_8","alias_value":"QDMZQQAD","created_at":"2026-06-09T02:07:18.239562+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW","json":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW.json","graph_json":"https://pith.science/api/pith-number/QDMZQQAD5TF6J7APY5ZEXBHXYW/graph.json","events_json":"https://pith.science/api/pith-number/QDMZQQAD5TF6J7APY5ZEXBHXYW/events.json","paper":"https://pith.science/paper/QDMZQQAD"},"agent_actions":{"view_html":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW","download_json":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW.json","view_paper":"https://pith.science/paper/QDMZQQAD","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2601.20408&json=true","fetch_graph":"https://pith.science/api/pith-number/QDMZQQAD5TF6J7APY5ZEXBHXYW/graph.json","fetch_events":"https://pith.science/api/pith-number/QDMZQQAD5TF6J7APY5ZEXBHXYW/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW/action/timestamp_anchor","attest_storage":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW/action/storage_attestation","attest_author":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW/action/author_attestation","sign_citation":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW/action/citation_signature","submit_replication":"https://pith.science/pith/QDMZQQAD5TF6J7APY5ZEXBHXYW/action/replication_record"}},"created_at":"2026-06-09T02:07:18.239562+00:00","updated_at":"2026-06-09T02:07:18.239562+00:00"}