{"as_of":"2026-08-22T11:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f11600ac8f5d1ed5fe6c533c621523cdaf27c5018eed3ab0c11a85b5badc0c7c","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:07:50.015655Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11830/citation-record","integrity":"/paper/2507.11830/integrity","json":"/paper/2507.11830/citation-record.json","paper":"/paper/2507.11830"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:52.600778Z","title":"ArcticInference: A vLLM plugin for low-latency, high-throughput LLM inference,","venue":null,"work_id":"a7baf763-e336-4016-9e1d-39c56fc6be83","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:47.964242Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:b56f9bfb29461bc5dbef9a830aa995fc231dda0375eadf9940265eea6f94afcf","observation_id":"a9d09ec2-0f9b-424b-ac48-e4c3be0c17b0","resolution":{"observed_at":"2026-08-06T17:07:52.666591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:52.387435Z","title":"vLLM: A high-throughput and memory-efficient inference and serving engine for LLMs,","venue":null,"work_id":"93f61de7-4780-4ed1-ac83-73ef261e175f","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:48.129680Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:6de8d416c1869418ac4bad0f37dcb5c59c0333595a91edab03f33a902ed5994e","observation_id":"ed59c440-f18d-43aa-9291-7af45fce97b6","resolution":{"observed_at":"2026-08-06T17:07:52.514805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:52.163071Z","title":"Arctic inference with shift parallelism: The fastest open source inference,","venue":null,"work_id":"5e1e1092-e2e6-4e2c-bcc9-0590c03a4fa0","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:48.304419Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:459663bf4af316cb0b7725c9f06be85ab56fcfa626277fc5eebee22243510ca5","observation_id":"e33b1387-c400-4122-95f9-a0b51336cbd7","resolution":{"observed_at":"2026-08-06T17:07:52.262790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:51.938078Z","title":"Fastest speculative decoding in vLLM with Arctic In- ference and Arctic Training,","venue":null,"work_id":"e795580c-34bc-4f02-9783-36baf874c9fe","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:48.470495Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:5d3717dd6eb130b4ca6cbeabb74f677d622e375e9f55b7af3fd2322f8b9ba721","observation_id":"769b248b-c7b5-4e9e-98f0-bd4a80f09ce4","resolution":{"observed_at":"2026-08-06T17:07:52.046925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:51.703708Z","title":"SwiftKV: Accelerating enterprise LLM workloads,","venue":null,"work_id":"dfc63291-82aa-4f98-ac04-ca9d6879f9ff","year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:48.656658Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:e880dd7c1c38a69d18faa48e0b6b8f1da199d398797dfa23aa131128b5fa8bde","observation_id":"2ac1eef1-7bec-45a9-b61a-610f47a00294","resolution":{"observed_at":"2026-08-06T17:07:51.809237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:51.471900Z","title":"Scaling vLLM for embed- dings: 16× throughput and cost reduction,","venue":null,"work_id":"58072e2c-3260-46b8-b0fc-8070b38c8733","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:48.818167Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:f159b50f8c3a0965ba0ea322b1a84ea1389a83d2afde00a295c4e21679667fbd","observation_id":"e04aa1b5-ad5b-4651-be42-88249b233789","resolution":{"observed_at":"2026-08-06T17:07:51.597465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:51.240290Z","title":"Text embeddings inference (TEI): A blazing fast inference solution for text embeddings models,","venue":null,"work_id":"7e56337e-802c-4e44-b776-c121267dea62","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.035007Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:f1153955d6972a065ca26c3d9f628766180465dfddd0955d11d560b5939a5b7f","observation_id":"669d2eb2-2f5f-4f26-87bc-a944c69dd787","resolution":{"observed_at":"2026-08-06T17:07:51.337046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:51.035721Z","title":"Ulysses: Unlocking low- latency, high-throughput inference for long context LLMs,","venue":null,"work_id":"5581f0bf-458a-4b4f-b28a-88cd895eaaec","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.212775Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:780c7f646446701cd5a6ac88f5dacf434750840b67cac3a804dc002573ef6ded","observation_id":"5e8a30f2-a3f5-411b-9d2c-7b10822835d5","resolution":{"observed_at":"2026-08-06T17:07:51.117411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-06T17:07:49.295482Z","title":"EAGLE: Speculative sampling requires rethinking feature uncertainty,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.295482Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:da91676b77c5ba25f6cf32f2242bd5798423c76e4bea279eee49195457aa15d4","observation_id":"44f26583-8196-4c64-a2cd-1f45a0ab8d87","resolution":{"observed_at":"2026-08-06T17:07:49.295482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:50.848626Z","title":"SGL: a fast serving framework for large language models and vision lan- guage models,","venue":null,"work_id":"faf1f1df-0e33-4ace-8984-7b96b5c9caca","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.359127Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:a8e8028197442a32b9a42b57fc9c8348c242b0ed1fb9b37ff12cb5716a5a9f56","observation_id":"0e27ff2c-d51b-4998-9e6d-dbd1c1acf8a5","resolution":{"observed_at":"2026-08-06T17:07:50.950157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-06T17:07:49.434773Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.434773Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:7a9f6501eeb1e464c1bf560140b338f17ec6105185b904c97d840b5099cbd977","observation_id":"5be0fa01-88b5-4752-87e2-64538dd9f49c","resolution":{"observed_at":"2026-08-06T17:07:49.434773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-08-18T16:18:58.765617Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-06T17:07:49.498215Z","title":"SGLang: Efficient execution of structured language model programs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.498215Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:d080a820069676cc1abc305dc34eea5bd290172a26d910200a5a815d5ae765b7","observation_id":"b45fc42c-5abd-4cfc-bde5-a65046daedaa","resolution":{"observed_at":"2026-08-06T17:07:49.498215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:50.663712Z","title":"TensorRT-LLM,","venue":null,"work_id":"9c90427e-6f02-47aa-911c-b7c566ec27fa","year":2025},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.577355Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:a1d37c9d5d2fe43e2dc5079d72b71a255835a79ccc2fc0aeaa77fcd3d68e55e9","observation_id":"d378fcf3-1c7f-4c67-b4bb-e68de15a8097","resolution":{"observed_at":"2026-08-06T17:07:50.746191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03960","last_updated":"2025-06-02T02:08:06Z","snapshot_observed_at":"2026-08-19T10:12:42.327481Z","submitted_at":"2024-10-04T22:45:26Z","title":"SwiftKV: Fast Prefill-Optimized Inference with Knowledge-Preserving Model Transformation","version":3},"cited_work":{"arxiv_id":"2410.03960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03960","snapshot_observed_at":"2026-08-06T17:07:50.191721Z","title":"SwiftKV: Fast Prefill-Optimized Inference with Knowledge-Preserving Model Transformation","venue":"cs.LG","work_id":"d66c0dd4-a43f-4090-b588-c572a099ad19","year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.638141Z"},"links":{"cited_paper":"/paper/2410.03960","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:77c9c4ceb09d4af4449147bc4b35a42d6e7409c4642e298b596974bf50bc676a","observation_id":"d29f3e47-6589-42fc-afb3-58865839155c","resolution":{"observed_at":"2026-08-06T17:07:50.251441Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:50.481206Z","title":"ShareGPT Vicuna Unfiltered: Cleaned English ShareGPT Conversations,","venue":null,"work_id":"6427e8f0-0316-4a49-83f0-a3dc01712ac1","year":2023},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.709957Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:13e100f9153293eb0e89609093f3ecdae31870e8eafbb201e8925378c6f8406a","observation_id":"489e20fb-d110-4485-8fce-735364e2acb5","resolution":{"observed_at":"2026-08-06T17:07:50.559135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T17:07:49.770247Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.770247Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:ffc242a6b263da115fd3ca1027145c7891901565dffdb2bf77738070a25b6837","observation_id":"a9349f7f-2961-4b2d-926c-1e0a3301d502","resolution":{"observed_at":"2026-08-06T17:07:49.770247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-18T08:11:45.716032Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-06T17:07:49.829597Z","title":"SWE-bench: Can language models resolve real-world GitHub issues?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.829597Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:91ca7dd85baf55f32d02032520209b152e122a600d1301d0743b42b6879621e3","observation_id":"51dec79e-d360-4aea-8d48-101c85dc783d","resolution":{"observed_at":"2026-08-06T17:07:49.829597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:07:49.890248Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.890248Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:c20f57ad28b7b31dd6405b6605107045e9055be7c35055f7390882aaa2196417","observation_id":"5f2b566b-4b0a-4dcd-a7f1-fdfc2ef75caa","resolution":{"observed_at":"2026-08-06T17:07:49.890248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05374","last_updated":"2024-05-08T19:05:18Z","snapshot_observed_at":"2026-08-18T00:19:43.445823Z","submitted_at":"2024-05-08T19:05:18Z","title":"Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05374","snapshot_observed_at":"2026-08-06T17:07:49.956821Z","title":"Arctic-embed: Scalable, efficient, and accurate text embedding models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:49.956821Z"},"links":{"cited_paper":"/paper/2405.05374","citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:0d895ef560ce86c430fe0d200212527d1d8b8d1c0c3bc29dc1ebb0594ff391cd","observation_id":"25ab451c-48e0-473d-b052-c177c268a35e","resolution":{"observed_at":"2026-08-06T17:07:49.956821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:07:50.325801Z","title":"bge-base-en-v1.5: English text embedding model,","venue":null,"work_id":"5f526f28-13eb-4896-9fd4-312b7112d08f","year":2024},"citing_paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:50.015655Z"},"links":{"citing_paper":"/paper/2507.11830"},"observation_digest":"sha256:20c652c783dc9ba5c04b2c04ead7f19f5414dac52e6b37b7f13d37c64723965c","observation_id":"6914d288-1c91-4216-86f6-98696fb04c30","resolution":{"observed_at":"2026-08-06T17:07:50.393517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11830","last_updated":"2025-07-16T01:32:31Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-20T10:39:07.743653Z","submitted_at":"2025-07-16T01:32:31Z","title":"Arctic Inference with Shift Parallelism: Fast and Efficient Open Source Inference System for Enterprise AI"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.11830."}