{"as_of":"2026-08-09T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:364c3792be4b7b6a1c2fcf211e3c0bb016e8226d5f5e436197b9a07c3173bfd7","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:42:15.171177Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:21.520298Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T09:19:54.344822Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05609","snapshot_observed_at":"2026-08-07T14:14:21.520298Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-08T14:46:12.061876Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.520298Z"},"links":{"cited_paper":"/paper/2502.05609","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:20ab9d7e915129dd6a40664bfcff15158a52b503ffbdbb496db3042e6dcf4234","observation_id":"512295ff-e0ef-409b-94d9-2f00cf25795f","resolution":{"observed_at":"2026-08-07T14:14:21.520298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"cited_work":{"arxiv_id":"2502.05609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05609","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dc2f2d2c-e4f2-4032-ad0a-7b1e7cd4adda","year":2025},"citing_paper":{"arxiv_id":"2603.17573","last_updated":"2026-04-27T12:41:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-18T10:25:08Z","title":"HeiSD: Hybrid Speculative Decoding for Embodied Vision-Language-Action Models with Kinematic Awareness","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T09:15:50.963123Z"},"links":{"cited_paper":"/paper/2502.05609","citing_paper":"/paper/2603.17573"},"observation_digest":"sha256:c7aa86a99c376e3b9d24638a322309ef94417577ab36d5166ff5b64edfd2fbd0","observation_id":"61a54cbb-ae6f-49ce-8249-a1a734c7471d","resolution":{"observed_at":"2026-05-15T09:19:54.348149Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05609/citation-record","integrity":"/paper/2502.05609/integrity","json":"/paper/2502.05609/citation-record.json","paper":"/paper/2502.05609"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8395.28428","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.060072Z","title":"Chandra, and Marc Snir","venue":null,"work_id":"31387052-ae25-4210-9ead-13edc00819cd","year":1987},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.933330Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:4e4b286e20593bc93729e30ee2390395923b09e9141efacae183f9c5ead3f3cb","observation_id":"6fcee68a-10e9-4b7e-8ece-4dabff19c560","resolution":{"observed_at":"2026-08-08T18:42:16.067589Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-08T18:42:14.939397Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.939397Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:e63fecccbd07668d67971c6c45ca4367840c87353b763b0066e992c96f0ede0c","observation_id":"251c2da6-7c25-48db-a5ed-4acad6964e8a","resolution":{"observed_at":"2026-08-08T18:42:14.939397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.945269Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.945269Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:a87b69e3a22eaa592ef5d60184db6187092359e7dd5e8ef6e39ad7b821f3d02d","observation_id":"d953af77-e298-46da-a533-f88ee0ab0a78","resolution":{"observed_at":"2026-08-08T18:42:14.945269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.950561Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.950561Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:826b3ec428d5f422779a2357458d9690fc6a2d7180fd4d23253920a5ed77913d","observation_id":"09d5c4a8-a42c-4640-a985-0af2a6fc60ed","resolution":{"observed_at":"2026-08-08T18:42:14.950561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.955430Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.955430Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:ded9b46391f2889a62c7e8a3481f226c9d9898e8e4e4970a9b283aff22fecbfb","observation_id":"60cc7ea2-2e09-45f6-8899-1afbe06e216a","resolution":{"observed_at":"2026-08-08T18:42:14.955430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.326202Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"bcd7958e-c1b8-4183-b736-e447b94879cf","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.960598Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:64f1f5d0220b0d318a7f4fdfb87c11762879c78985d0a4f95d79bddb4586b4b8","observation_id":"baafcb4f-0178-4261-a8ec-d64720030fdf","resolution":{"observed_at":"2026-08-08T18:42:16.331099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-08T18:42:14.971410Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.971410Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:f0eb878c414ceeab2eb93e5294f2c128f275fefe8efd63c63ccbfb4f7370a91d","observation_id":"c76597ee-6577-4fa9-9c03-372268744932","resolution":{"observed_at":"2026-08-08T18:42:14.971410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T18:42:14.976169Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.976169Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:4bb371a7d41cf6a907ea41eaeded6d4d534ea0e4196130636f90342f4106a97c","observation_id":"670823e7-eebd-484e-9071-4045e9c4792f","resolution":{"observed_at":"2026-08-08T18:42:14.976169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.981480Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.981480Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:b636c770b1ff5420a6a8223eb290eb3569b0a206831fed02ef7335c798fac2a9","observation_id":"14c3f965-d832-4d0c-96c3-deb3d8fd0645","resolution":{"observed_at":"2026-08-08T18:42:14.981480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.986619Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.986619Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:8175c5edf2abcd52dd51d2e9dce9b1852cfcec248c9981c23a6df36d63bafc97","observation_id":"e4978392-a1b8-466b-bacc-d8d26494bdf4","resolution":{"observed_at":"2026-08-08T18:42:14.986619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.298134Z","title":null,"venue":null,"work_id":"3ab50369-f60f-447a-98fa-3d3dac56c419","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.991341Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:7227c411caddd3d9e1d490afc6aa038cf3ac144d4d98ec75b449c94a7a84dc7c","observation_id":"8cf1dc37-df03-459b-bf5f-aabbd06a6305","resolution":{"observed_at":"2026-08-08T18:42:16.303475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:14.996032Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:14.996032Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:e9721d32d3dc384ec66b0aba12ae99089aee48f889cd54d3c7ad79de9c6ac94b","observation_id":"954fa007-48cb-48de-bfec-04714bfc71da","resolution":{"observed_at":"2026-08-08T18:42:14.996032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.282948Z","title":null,"venue":null,"work_id":"ea80576f-b0d8-4fe5-935e-6593d5769ee1","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.000509Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:b55419c325313678488701f9ba9ebc8aa5d0a158a4be03b6e7e8a740f172736a","observation_id":"90510e72-7108-4df1-9a38-02a9a0930e78","resolution":{"observed_at":"2026-08-08T18:42:16.287816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.005433Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.005433Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:c5e2d62870c82cc082a977bead66199ff969d6b000298eb0adca5fa575a4797c","observation_id":"a7480ac7-6fd0-45ab-8a37-8284513cd686","resolution":{"observed_at":"2026-08-08T18:42:15.005433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07629","last_updated":"2024-06-05T03:57:41Z","snapshot_observed_at":"2026-08-05T21:17:46.828705Z","submitted_at":"2023-06-13T08:57:54Z","title":"SqueezeLLM: Dense-and-Sparse Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07629","snapshot_observed_at":"2026-08-08T18:42:15.010420Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.010420Z"},"links":{"cited_paper":"/paper/2306.07629","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:87d9ce452767dfc2a23dcddbabeef63db6011bec50891213a171bcabc6f19153","observation_id":"82638e70-4319-4cad-85ea-af7a65b3dd55","resolution":{"observed_at":"2026-08-08T18:42:15.010420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.267417Z","title":null,"venue":null,"work_id":"501dbb43-6486-4255-b838-546526f0fb95","year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.015668Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:54d05321215552fe81ee02eb1969b526c79b3e8e639b03f2c3caffd05d37da20","observation_id":"0c8a4623-4745-413e-b7a0-dfcf9be94b3a","resolution":{"observed_at":"2026-08-08T18:42:16.272293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.252060Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":"e7b71f51-9b0a-4aba-957d-2b1c989fa47c","year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.020330Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:8e447ab47368e45508159ef2c4d1a40102b7a2c1403b43d1048a0f24d9be1713","observation_id":"cf31d636-0f36-4330-af52-74241fc7a3e4","resolution":{"observed_at":"2026-08-08T18:42:16.256804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.025693Z","title":"Parikh, Chris Alberti, Danielle Epstein, Illia Polosukhin, Jacob Devlin, Kenton Lee, Kristina Toutanova, Llion Jones, Matthew Kelcey, Ming - Wei Chang, Andrew M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.025693Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:a52ce32d65670e398d89fe9f2bd9f6f2eb4402586ef5cdead6946490fb12b8bc","observation_id":"8b955bfc-3e22-4409-b480-66fe5f6e8881","resolution":{"observed_at":"2026-08-08T18:42:15.025693Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.030651Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.030651Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:5f1f64da37045a2af30df4f1bbd9c10c167c1ef5d2a31e288f6d2d88119ed2a6","observation_id":"9d4ed3c2-8be4-47ba-b86a-2dee408a07e0","resolution":{"observed_at":"2026-08-08T18:42:15.030651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.236430Z","title":null,"venue":null,"work_id":"5d0e5cb9-5279-4414-b2be-091943fc3ef6","year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.035477Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:7c6d3c2adccd6b51ed9d33b538f76b76c92ae31bd0af66a7f2c60766846c71a7","observation_id":"fca670cc-9c10-4e89-8a60-9d2a83ea4154","resolution":{"observed_at":"2026-08-08T18:42:16.241440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16858","last_updated":"2024-06-30T15:03:25Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:11Z","title":"EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16858","snapshot_observed_at":"2026-08-08T18:42:15.040214Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.040214Z"},"links":{"cited_paper":"/paper/2406.16858","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:58483384863a2fece03387a98308cda7a58f472f43a6669742a635315173ace7","observation_id":"d7bdff32-cf04-466d-8f82-aa628ca87153","resolution":{"observed_at":"2026-08-08T18:42:15.040214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.045181Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.045181Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:d0311a020bb3af11ea3ae29c0df175d3439f1cc6a5501e5c787930dedfba5b99","observation_id":"ca73317a-63e4-477b-a85e-bff1a4e6daed","resolution":{"observed_at":"2026-08-08T18:42:15.045181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08696","last_updated":"2025-05-25T12:10:14Z","snapshot_observed_at":"2026-08-08T01:17:06.603022Z","submitted_at":"2024-08-16T12:20:56Z","title":"Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08696","snapshot_observed_at":"2026-08-08T18:42:15.049947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.049947Z"},"links":{"cited_paper":"/paper/2408.08696","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:1dbd86cd75951ea9dc516759a30a63b2ad02580be8f620d28e4951b37918ad54","observation_id":"4bdb2ed7-8c12-4188-954e-406a4bf8c2b0","resolution":{"observed_at":"2026-08-08T18:42:15.049947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.055141Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.055141Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:ebb898157f23505e8b935fe7425002b781d455e71ddcacfa6cf3cb5097355748","observation_id":"dcf80767-3a84-4ffa-9d87-fb86454e1142","resolution":{"observed_at":"2026-08-08T18:42:15.055141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.060135Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.060135Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:648a25ec76c53735605c6ff2ebbc1a09810e45697437746d9510d0f756d3ebdd","observation_id":"ab8bb7e3-eff3-4515-bc4e-1f0c07082ad7","resolution":{"observed_at":"2026-08-08T18:42:15.060135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.067987Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.067987Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:383338f6855caacc16517e3f97a59a2e2badbfe9d42f8176d90fe173f793f50b","observation_id":"ac4b6173-0408-4188-ac64-aa22f44d662f","resolution":{"observed_at":"2026-08-08T18:42:15.067987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.074195Z","title":"Patterson","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.074195Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:e9d1630e82f8e4048c59b5e89afa683ad27bfc47587810c5b13eae18b3dad0e7","observation_id":"475681fe-c2b1-4353-9692-9fb55cde2687","resolution":{"observed_at":"2026-08-08T18:42:15.074195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.210361Z","title":null,"venue":null,"work_id":"f48195dd-56bf-4a78-bd2c-6957e51e1d1c","year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.078918Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:6daa6a8fd9ee0954ff4bfbb758fdf3017d55df702a575815d3d8375ba47f6f05","observation_id":"04ad2649-815c-4d96-b615-01a27522e5da","resolution":{"observed_at":"2026-08-08T18:42:16.215431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.194664Z","title":null,"venue":null,"work_id":"2f0359d9-9836-4a1b-b24e-43a9acade026","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.083484Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:551a225c126fcdcf6c044db481da8722e3f9f25a82f26e7facde486089909e64","observation_id":"750f93c6-96bb-4af7-90ee-807665b9c908","resolution":{"observed_at":"2026-08-08T18:42:16.199635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.087872Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.087872Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:03bc6d4d3adcf168bb016ac8ba39737bdb2aa99882c9224288202189d9041691","observation_id":"19db47fb-a138-44bf-902b-d0bd7f42a06a","resolution":{"observed_at":"2026-08-08T18:42:15.087872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.092516Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.092516Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:d2d2d705b14b25bd5856e8be02761e82f9ebadab20111eebd73c228ada441c48","observation_id":"a7dfa254-2731-40c5-9f29-43e033f19d55","resolution":{"observed_at":"2026-08-08T18:42:15.092516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-08T18:42:15.096988Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.096988Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:c66165f12e74a55f02756f6f13b2c7040c93b1f98278b08ee8c4b68a15f5fa83","observation_id":"7227293a-b44b-4ecc-ba54-3809cf6d4b2e","resolution":{"observed_at":"2026-08-08T18:42:15.096988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.168499Z","title":null,"venue":null,"work_id":"12ecde0c-826f-4c97-aa07-ad779b055f59","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.102132Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:424bba5717c6ecbad92d10428fb3c5bb4ccc959a9c7581d0a687a65e4d32126e","observation_id":"b67b68e3-2ae1-4a48-8e95-5edaf4344bc0","resolution":{"observed_at":"2026-08-08T18:42:16.173396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04623","last_updated":"2023-08-08T23:29:55Z","snapshot_observed_at":"2026-08-09T00:36:07.880808Z","submitted_at":"2023-08-08T23:29:55Z","title":"Accelerating LLM Inference with Staged Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04623","snapshot_observed_at":"2026-08-08T18:42:15.107139Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.107139Z"},"links":{"cited_paper":"/paper/2308.04623","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:d2b54abc253a94e0aad390650f1b742768ace0b9044c02ae57c61f0991181099","observation_id":"bb22f7e5-b7cf-4918-b335-5a5512537478","resolution":{"observed_at":"2026-08-08T18:42:15.107139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.152793Z","title":null,"venue":null,"work_id":"986942f0-7f8a-44dd-9517-889a5cbbd9d7","year":2018},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.112127Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:a8718138891568a231e57c06cc887fce6b7d92c1645f3aa1cd1b5be9babc7ce0","observation_id":"af83926c-f22c-4a20-a3d2-11d54cd64e2f","resolution":{"observed_at":"2026-08-08T18:42:16.157729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T18:42:15.116726Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.116726Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:f8f551e30c37c2aef984152d1bffba1e4baa20755c42691fb2d3557905f2a394","observation_id":"9556c128-31dc-43f0-b39a-2902ce0b6315","resolution":{"observed_at":"2026-08-08T18:42:15.116726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.121906Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.121906Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:051e7d0b7027b4ef9353ad5a275b1c5ef3344783fab1b7b1b09c1f9a03b0811d","observation_id":"9916496e-31e5-436a-84ad-1e1024ee5dcc","resolution":{"observed_at":"2026-08-08T18:42:15.121906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.127040Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.127040Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:8f94416706712a4b5b981cb4b2e96350376391c6fd8c9003d87ea6733c74ed8a","observation_id":"ed87d95a-db03-4aeb-8224-43ca8e6a7508","resolution":{"observed_at":"2026-08-08T18:42:15.127040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04487","last_updated":"2023-04-10T09:55:14Z","snapshot_observed_at":"2026-08-08T22:26:19.481629Z","submitted_at":"2023-04-10T09:55:14Z","title":"Inference with Reference: Lossless Acceleration of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04487","snapshot_observed_at":"2026-08-08T18:42:15.131740Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.131740Z"},"links":{"cited_paper":"/paper/2304.04487","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:5f18de82afa58051b7d3bbf22cfafc626e722966b5d3937aee6161119485a3b3","observation_id":"9a8efe3b-b0eb-4639-9683-81eae12dbf4c","resolution":{"observed_at":"2026-08-08T18:42:15.131740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.136397Z","title":null,"venue":null,"work_id":"29e7728c-ba77-449b-ae3a-97542bf5b653","year":2022},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.136772Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:1c3564c2e612914c0451b05c37e8733a6e03c255f1ac29b8298b094c0e93a07a","observation_id":"32ca7678-766f-4aa7-a3f1-79a0a1eae9de","resolution":{"observed_at":"2026-08-08T18:42:16.141465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16758","last_updated":"2024-11-11T07:34:25Z","snapshot_observed_at":"2026-07-06T18:36:07.983955Z","submitted_at":"2024-06-24T16:06:50Z","title":"Towards Fast Multilingual LLM Inference: Speculative Decoding and Specialized Drafters","version":2},"cited_work":{"arxiv_id":"2406.16758","doi":"10.48550/arxiv.2406.16758","metadata_source":"pith","pith_arxiv_id":"2406.16758","snapshot_observed_at":"2026-08-09T00:16:22.132183Z","title":"Towards Fast Multilingual LLM Inference: Speculative Decoding and Specialized Drafters","venue":"cs.CL","work_id":"c32b6a61-9a3b-49bc-b5ec-34737539815c","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.141623Z"},"links":{"cited_paper":"/paper/2406.16758","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:cedf73ca94d37b4a4940b2be217f0041ad61c39334bee52439ab134d41ceed81","observation_id":"cb0dfb7d-c82f-4609-a07d-062b762e778b","resolution":{"observed_at":"2026-08-08T18:42:15.237786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-08T18:42:15.146922Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.146922Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:81d143e4ad399563d50aa5affc009384a3899880dd7454ad221f7798ad703f43","observation_id":"35c70148-7de9-450d-9a49-60a1986827d5","resolution":{"observed_at":"2026-08-08T18:42:15.146922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.151791Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.151791Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:096f68938ff6a91ba604a1f082c8ef53ca2c6ebf843457b29150cc515614e3cb","observation_id":"69f869ef-6115-4a00-b32a-d38f0bca5285","resolution":{"observed_at":"2026-08-08T18:42:15.151791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.156291Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.156291Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:58d5d47ffd5c2ab54c80f6bba6eeeb32eea22e3b289a625818988a3f10c86164","observation_id":"c74c0f5c-fb70-4011-ad59-a031f2182df3","resolution":{"observed_at":"2026-08-08T18:42:15.156291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:16.100110Z","title":null,"venue":null,"work_id":"8b3fdd90-a304-401a-9a37-4fa055169c95","year":2024},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.161034Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:266d6da4f06acaffebbe875dc4e58cceced1b1fd8d348a81675b3f86b514a059","observation_id":"e59a4ecd-2b8d-44cb-839c-1ad196c2bdbf","resolution":{"observed_at":"2026-08-08T18:42:16.104927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.165690Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.165690Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:5dfd565a7becd3085d7f2158eead0d188d69a7f32237259af2059e9bf3bfa666","observation_id":"65223a9c-9ede-4605-b468-21b56f5ba059","resolution":{"observed_at":"2026-08-08T18:42:15.165690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T18:42:15.171177Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T18:42:15.171177Z"},"links":{"citing_paper":"/paper/2502.05609"},"observation_digest":"sha256:1b08509621e969af06b684bceb825daf829343afcb95cc2acac6c53647df2ee3","observation_id":"69fb4074-f375-4de7-8ed6-14b61166c723","resolution":{"observed_at":"2026-08-08T18:42:15.171177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T00:36:24.320270Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2502.05609."}