{"as_of":"2026-08-10T14:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:705381b6a67efd56c7dc39eb1a585fbe7523df5292f1c493265568d26ff86ed6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:43:27.532056Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T05:52:37.526395Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":"2402.11131","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speculative streaming: Fast llm inference without auxiliary models","venue":null,"work_id":"9eadb528-c182-471c-a064-f42837d4aa27","year":2024},"citing_paper":{"arxiv_id":"2501.05465","last_updated":"2026-05-14T16:52:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-03T19:53:57Z","title":"Small Language Models (SLMs) Can Still Pack a Punch: A survey (updated 2026)","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T05:47:48.488826Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2501.05465"},"observation_digest":"sha256:e614ca819047569e1a9d9c5d70605aa37af8140fcb7c51ff9fe7b049f57cacc8","observation_id":"a02f28c2-4398-40ae-b504-4adb62a11546","resolution":{"observed_at":"2026-05-23T05:52:37.531501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-09T20:43:27.532056Z","title":"Speculative streaming: Fast llm inference without auxiliary models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-09T20:34:15.481645Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.532056Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:eda8ec2e26af97c81854d058784d358cc790c2d57ced41b8103690a76929649f","observation_id":"55c28658-f78e-4556-8a76-5f94d086f314","resolution":{"observed_at":"2026-08-09T20:43:27.532056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-09T13:58:44.876800Z","title":"Speculative streaming: Fast llm inference without auxiliary models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01976","last_updated":"2025-09-10T02:45:51Z","snapshot_observed_at":"2026-08-10T05:45:27.998309Z","submitted_at":"2025-02-04T03:36:44Z","title":"CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing","version":6},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T13:58:44.876800Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2502.01976"},"observation_digest":"sha256:b809efe91157fc590e097b001932a33c1e6608846aff5d8bd989d227a0ca067b","observation_id":"2abcd8ac-4e7f-44c2-a606-6e08b53cde8c","resolution":{"observed_at":"2026-08-09T13:58:44.876800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-09T13:40:56.409002Z","title":"Speculative streaming: Fast llm inference without auxiliary models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02040","last_updated":"2025-02-04T06:13:52Z","snapshot_observed_at":"2026-08-09T14:19:20.730533Z","submitted_at":"2025-02-04T06:13:52Z","title":"M2R2: Mixture of Multi-Rate Residuals for Efficient Transformer Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T13:40:56.409002Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2502.02040"},"observation_digest":"sha256:19fd203d088b8738829dc6b3f9a3b88039d1eb4c9174cd5651011ca23cdf24c8","observation_id":"0d7e73a3-b19b-4020-8b21-4c906ee9a86a","resolution":{"observed_at":"2026-08-09T13:40:56.409002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-09T04:28:03.898221Z","title":"Bhendawade, N., Belousova, I., Fu, Q., Mason, H., Raste- gari, M., and Najibi, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10424","last_updated":"2025-02-05T20:43:48Z","snapshot_observed_at":"2026-08-09T15:11:12.836727Z","submitted_at":"2025-02-05T20:43:48Z","title":"QuantSpec: Self-Speculative Decoding with Hierarchical Quantized KV Cache","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-09T04:28:03.898221Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2502.10424"},"observation_digest":"sha256:9f573ede0f82881207d58b43a32fce8dec3b3bd08b466da85fd992b1784567e8","observation_id":"4c04e46d-7b85-4a4a-89a6-1e6ba3cd289f","resolution":{"observed_at":"2026-08-09T04:28:03.898221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-06T17:06:07.458918Z","title":"Speculative streaming: Fast llm inference without auxiliary models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-06T16:57:42.573867Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.458918Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:3eae8b9876ef8df4b9ab6d441e4153a23f1c02e33fc3e30fe5c6bff74cd59fdc","observation_id":"31054bfa-44b0-4869-8a8e-e466a8545f10","resolution":{"observed_at":"2026-08-06T17:06:07.458918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":"2402.11131","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speculative streaming: Fast llm inference without auxiliary models","venue":null,"work_id":"9eadb528-c182-471c-a064-f42837d4aa27","year":2024},"citing_paper":{"arxiv_id":"2605.07325","last_updated":"2026-05-08T06:30:44Z","snapshot_observed_at":"2026-08-02T20:19:45.405138Z","submitted_at":"2026-05-08T06:30:44Z","title":"CSR: Infinite-Horizon Real-Time Policies with Massive Cached State Representations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T00:55:51.126210Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2605.07325"},"observation_digest":"sha256:9eaf5d47cd85738ec6d7f4ce42dcf66ea5a213af5f86bda170c12c351b8b675e","observation_id":"4a3dc938-8149-45cf-8772-de4aea22ac62","resolution":{"observed_at":"2026-05-11T05:00:55.566889Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-01T09:35:52.548132Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20723","last_updated":"2026-07-22T20:51:28Z","snapshot_observed_at":"2026-08-10T08:34:02.187214Z","submitted_at":"2026-07-22T20:51:28Z","title":"Leaky Language Models: Stealing Architecture and Inference Optimizations via Per-Token Timing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T09:35:52.548132Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2607.20723"},"observation_digest":"sha256:11b100426c3bbbd3659552cab480617c3c99083e0078f2e08b36904ff6d08e89","observation_id":"529d8384-7001-4f9c-b503-3d4eb6bbac29","resolution":{"observed_at":"2026-08-01T09:35:52.548132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.11131/citation-record","integrity":"/paper/2402.11131/integrity","json":"/paper/2402.11131/citation-record.json","paper":"/paper/2402.11131"},"outbound":[],"paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:31:29.199601Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2402.11131."}