{"as_of":"2026-08-13T21:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d91c7902d994bc23c54a16d56bd8c317894bec5fb1f0a27ab647b785ddd1b06","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:25:53.227957Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:16:44.241382Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:53:15.807429Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18910","snapshot_observed_at":"2026-08-12T11:16:44.241382Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18462","last_updated":"2025-08-24T15:48:28Z","snapshot_observed_at":"2026-08-12T11:08:42.220089Z","submitted_at":"2024-11-27T15:53:17Z","title":"Draft Model Knows When to Stop: Self-Verification Speculative Decoding for Long-Form Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T11:16:44.241382Z"},"links":{"cited_paper":"/paper/2412.18910","citing_paper":"/paper/2411.18462"},"observation_digest":"sha256:faf0e253ca9b3d08a681fa01c41b6f27b4ebc4801152c455273e89becaff0125","observation_id":"b08368b2-7f81-4bc0-9f26-f5df838c94ad","resolution":{"observed_at":"2026-08-12T11:16:44.241382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"cited_work":{"arxiv_id":"2412.18910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18910","snapshot_observed_at":"2026-06-29T08:53:15.807429Z","title":"Adaeagle: Optimizing speculative decoding via explicit modeling of adaptive draft structures, 2024 b","venue":null,"work_id":"ea26080a-2dd4-42d4-ac9e-612b7b6abad5","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-08-12T16:50:37.846017Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2412.18910","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:b18f53f37fa47dc48077d180e4c892b2773dab441a26c9b037982cec503817ff","observation_id":"c74aa8a4-11e6-45e3-8260-f48ea7ff17a7","resolution":{"observed_at":"2026-05-19T06:57:08.140921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"cited_work":{"arxiv_id":"2412.18910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18910","snapshot_observed_at":"2026-06-29T08:53:15.807429Z","title":"Adaeagle: Optimizing speculative decoding via explicit modeling of adaptive draft structures, 2024 b","venue":null,"work_id":"ea26080a-2dd4-42d4-ac9e-612b7b6abad5","year":2024},"citing_paper":{"arxiv_id":"2605.29727","last_updated":"2026-05-28T10:21:34Z","snapshot_observed_at":"2026-08-02T01:53:53.633149Z","submitted_at":"2026-05-28T10:21:34Z","title":"Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:11.662084Z"},"links":{"cited_paper":"/paper/2412.18910","citing_paper":"/paper/2605.29727"},"observation_digest":"sha256:edb85f3cadd8bbd43945991df67f5e33d5570eee8df6061fa8049e03a6c8ec13","observation_id":"8301b1c8-835d-412e-ba39-a6726e1a21f1","resolution":{"observed_at":"2026-06-29T08:53:15.808995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18910","snapshot_observed_at":"2026-08-05T00:46:52.038602Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00531","last_updated":"2026-08-01T08:43:34Z","snapshot_observed_at":"2026-08-13T18:09:56.734339Z","submitted_at":"2026-08-01T08:43:34Z","title":"CURE: Local Uncertainty Repair for Block-Parallel Speculative Decoding","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-05T00:46:52.038602Z"},"links":{"cited_paper":"/paper/2412.18910","citing_paper":"/paper/2608.00531"},"observation_digest":"sha256:1f62186b961b8549d4e0d04a647c3cf3034bd8f7e88b586e427464114ed87fac","observation_id":"59a2ae35-4816-471e-9855-418fa1ac45b1","resolution":{"observed_at":"2026-08-05T00:46:52.038602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18910/citation-record","integrity":"/paper/2412.18910/integrity","json":"/paper/2412.18910/citation-record.json","paper":"/paper/2412.18910"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.067545Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.067545Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:969899b01f1b905bff270a192f9d2439e3676cc4aa23560f15805a0780d1599f","observation_id":"ab5d5c69-bea9-447b-a4b3-8ad891a1a4aa","resolution":{"observed_at":"2026-08-11T04:25:53.067545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.072818Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.072818Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:8cc49e69e2d8748f5638274178b6176c0b7c5fa201d05d86575e6eb28361d78d","observation_id":"9bedea07-b59c-4609-b75a-56890e146f1a","resolution":{"observed_at":"2026-08-11T04:25:53.072818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00142","last_updated":"2024-08-30T03:27:48Z","snapshot_observed_at":"2026-08-13T14:54:26.068970Z","submitted_at":"2024-08-30T03:27:48Z","title":"Dynamic Depth Decoding: Faster Speculative Decoding for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00142","snapshot_observed_at":"2026-08-11T04:25:53.077768Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.077768Z"},"links":{"cited_paper":"/paper/2409.00142","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:7c075c66cd78fcfb8d2bbd2502a5e38ca35ffa597e72b66f82aebc85fd113da4","observation_id":"4ac2cbac-95e0-4f9a-ad3b-ae3f831ac12a","resolution":{"observed_at":"2026-08-11T04:25:53.077768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.082979Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.082979Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:6c2155813b8478e1fee56d1a0d911e6bd35514ea8f25f1d0ce3b5a35b791b66c","observation_id":"760913b3-3a0e-4398-ac14-8e4158924992","resolution":{"observed_at":"2026-08-11T04:25:53.082979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.581665Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"6cfe552c-d869-49d8-a8b1-a6eb34ae7d41","year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.087207Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:b5adb163ea383c8d8edc01a769fa6b9045a143ee11c34ccdd7b9351545243447","observation_id":"dbe25d49-0da4-4cfa-a9b7-4985def56ee3","resolution":{"observed_at":"2026-08-11T04:25:53.586299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-10T21:52:49.568983Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-11T04:25:53.091462Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.091462Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:8391b33ffe7469b420da37d38446fe8393125f4646a9159bb48e6f6698cb3edf","observation_id":"2f9cfe72-41ba-4134-805d-fe7cf426a642","resolution":{"observed_at":"2026-08-11T04:25:53.091462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-11T04:25:53.096036Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.096036Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:f3c05780e4b48b9099b27b16cff24026e668a36f3c7f0185a4db8537110f0fa8","observation_id":"47c290b7-d06e-4cab-98b7-b4cb2044cc27","resolution":{"observed_at":"2026-08-11T04:25:53.096036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-13T04:15:09.481659Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-11T04:25:53.100231Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.100231Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:083070d15317e759adbcb0a56f5e9b3c041ca3c2bd793ce1f7df32b66a259d27","observation_id":"a40863f7-175d-432d-b6b2-ed8f07b2474b","resolution":{"observed_at":"2026-08-11T04:25:53.100231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.104880Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.104880Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:cbf777e5ca47f97ff8c3a1497a36da8ad9d426d040a8c8ad2b1a3c284ac1fd0a","observation_id":"773a3ffd-0c5b-4c9e-ab1f-43af3a58258f","resolution":{"observed_at":"2026-08-11T04:25:53.104880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T04:25:53.109173Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.109173Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:a7390c5a12974189f3345e8f2e6fe484e650afaacec1ce27178e68c691ec4e02","observation_id":"bdbca851-31e5-4237-b1df-26bfe1b010bf","resolution":{"observed_at":"2026-08-11T04:25:53.109173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.114039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.114039Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:3c2196b0d2e604f59f6c063f9a1b50e525dc29131a966612a20d89f1731b256a","observation_id":"32b1f33d-8b27-4a71-908e-d7ffc1d085aa","resolution":{"observed_at":"2026-08-11T04:25:53.114039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19715","last_updated":"2025-07-11T01:33:18Z","snapshot_observed_at":"2026-08-12T23:54:33.795003Z","submitted_at":"2024-05-30T05:49:38Z","title":"SpecDec++: Boosting Speculative Decoding via Adaptive Candidate Lengths","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19715","snapshot_observed_at":"2026-08-11T04:25:53.118289Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.118289Z"},"links":{"cited_paper":"/paper/2405.19715","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:b49364ec983c9a6dce65a2f26148e377de7dc8224f5f823471fb10cdef7a6f17","observation_id":"bea7004f-82d7-437a-97a9-d137b30cf6a2","resolution":{"observed_at":"2026-08-11T04:25:53.118289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.123264Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.123264Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:0fd46fa02a6033e06d2cfe8f4d13f77c2286534c0719e9bb8fe9da62820cd776","observation_id":"7b86ba64-f652-4204-99c7-ad472503bacc","resolution":{"observed_at":"2026-08-11T04:25:53.123264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.127304Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.127304Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:b5e975ec1c0b2fcbc9d5522c05f520c85f87bf6eb3b6a5d4232aaa348a276b9b","observation_id":"0f049a98-6c6f-4567-bf20-ce177a944269","resolution":{"observed_at":"2026-08-11T04:25:53.127304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16858","last_updated":"2024-06-30T15:03:25Z","snapshot_observed_at":"2026-08-13T18:09:06.904816Z","submitted_at":"2024-06-24T17:59:11Z","title":"EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16858","snapshot_observed_at":"2026-08-11T04:25:53.131063Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.131063Z"},"links":{"cited_paper":"/paper/2406.16858","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:131ef0a59f0934c602998683a92daebf7037cd5fa784eabd6f0011597414f385","observation_id":"34303879-757f-4582-a1cd-c9eda648bd31","resolution":{"observed_at":"2026-08-11T04:25:53.131063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.549758Z","title":null,"venue":null,"work_id":"901ff7b7-ab5b-4739-a6eb-e4880536ac3a","year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.136142Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:a162008b06d2e91f97085a8ed02028df6e0a9009e84c9e22c3e818072c2d8277","observation_id":"80a5134f-213b-4e15-8ba6-dc91c3cac5cd","resolution":{"observed_at":"2026-08-11T04:25:53.553383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18911","last_updated":"2024-04-29T17:53:54Z","snapshot_observed_at":"2026-08-13T00:19:14.097200Z","submitted_at":"2024-04-29T17:53:54Z","title":"Kangaroo: Lossless Self-Speculative Decoding via Double Early Exiting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18911","snapshot_observed_at":"2026-08-11T04:25:53.140005Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.140005Z"},"links":{"cited_paper":"/paper/2404.18911","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:fa961840a799c420cd8dd7184ae50af1434c5159e40948271bf718b330f5652e","observation_id":"1361995a-8eec-4bda-868e-606d4459e3ab","resolution":{"observed_at":"2026-08-11T04:25:53.140005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11850","last_updated":"2025-02-17T03:33:50Z","snapshot_observed_at":"2026-08-12T23:04:27.100022Z","submitted_at":"2024-08-13T08:32:06Z","title":"PEARL: Parallel Speculative Decoding with Adaptive Draft Length","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11850","snapshot_observed_at":"2026-08-11T04:25:53.144896Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.144896Z"},"links":{"cited_paper":"/paper/2408.11850","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:288b14f40c37c67bb7c2febd0fb6ffdfef8b09ee6306516dc3b547afeb43155e","observation_id":"97176d96-5cbf-4806-8a23-35be29746cdb","resolution":{"observed_at":"2026-08-11T04:25:53.144896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04304","last_updated":"2024-11-07T12:59:39Z","snapshot_observed_at":"2026-08-13T00:13:06.946729Z","submitted_at":"2024-05-07T13:27:52Z","title":"Dynamic Speculation Lookahead Accelerates Speculative Decoding of Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04304","snapshot_observed_at":"2026-08-11T04:25:53.149411Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.149411Z"},"links":{"cited_paper":"/paper/2405.04304","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:80aeacc52bd77b5e6c18689fca910289f209fa5ebc9dd0d8769f2dc3913e9643","observation_id":"7fb87b5c-6201-4219-b3a6-4c12cd108da1","resolution":{"observed_at":"2026-08-11T04:25:53.149411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.153714Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.153714Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:08e00228cf84565ed7491b2a2454e5d1c49d5a6c323b545da88d181b526cd0cf","observation_id":"c34a9a63-b66a-47e2-a22e-c31aa47bea11","resolution":{"observed_at":"2026-08-11T04:25:53.153714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.539138Z","title":null,"venue":null,"work_id":"96e4ae28-f8ed-41a0-a271-c077bb66754b","year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.157915Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:f3adda61c3599fd1e84171b3b955d9bfa55c23a18a9e06853bbe370bcfb561b2","observation_id":"4c15cf7d-f855-4f78-8676-aa194418137f","resolution":{"observed_at":"2026-08-11T04:25:53.542721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.162100Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.162100Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:f5f5bd13c4d68ea55e4d49e99c4a63953fc6ec103a5ce6a5bba4847c91bed114","observation_id":"bf533a0f-22ae-4046-9e6f-c954d8fbbc01","resolution":{"observed_at":"2026-08-11T04:25:53.162100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.166286Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.166286Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:61ea14cf0b851e62354028d6192d8ba7cd7e387328bd76dcb078f1cc4a68b655","observation_id":"98917941-811c-4475-9a8a-964aaddc5d3c","resolution":{"observed_at":"2026-08-11T04:25:53.166286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04623","last_updated":"2023-08-08T23:29:55Z","snapshot_observed_at":"2026-08-13T10:38:17.259933Z","submitted_at":"2023-08-08T23:29:55Z","title":"Accelerating LLM Inference with Staged Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04623","snapshot_observed_at":"2026-08-11T04:25:53.170857Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.170857Z"},"links":{"cited_paper":"/paper/2308.04623","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:e1b6bf181da6880bb0ca2381e33178ce038b53453866eb02114f9250fb5286c5","observation_id":"f45bc769-8acf-43be-b49e-03dd2d6a7550","resolution":{"observed_at":"2026-08-11T04:25:53.170857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.175514Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.175514Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:208366b97c942089be396c653f609f8f57949e0cd813e41a81a42e0cf16da5ef","observation_id":"6174d122-20b7-4392-8938-42570dc80876","resolution":{"observed_at":"2026-08-11T04:25:53.175514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.179640Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.179640Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:78e0f2bea69f70809e8004e91831b838f23f64b93d361ba8a71a641283028e5b","observation_id":"839f1249-f2a0-45de-baf4-3b3eb955be60","resolution":{"observed_at":"2026-08-11T04:25:53.179640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.513851Z","title":"Hashimoto","venue":null,"work_id":"08d38015-483c-4fdf-ae8c-8a344a66771f","year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.183648Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:835d69af35d929d6f4dc2705378f21ce5ddd294942e113f91829ad1b67e5d042","observation_id":"7a62e854-bc8b-4369-992f-610aa7538ae4","resolution":{"observed_at":"2026-08-11T04:25:53.517817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T04:25:53.188322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.188322Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:c09ec8dc318b600ff513cb274d03c448b4ba230cdd3c07b92015b3e143e059c4","observation_id":"db0bc37e-f55b-4b7f-801e-cc6832c81c9b","resolution":{"observed_at":"2026-08-11T04:25:53.188322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T04:25:53.192609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.192609Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:45b17357d888ca9ecd67add9348001e2e4b7e0aafcda3348fd855e5c710e1453","observation_id":"09725297-dec7-46de-9346-ae2ab54e7b9c","resolution":{"observed_at":"2026-08-11T04:25:53.192609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17276","last_updated":"2025-04-24T08:52:19Z","snapshot_observed_at":"2026-08-13T05:01:46.355716Z","submitted_at":"2024-06-25T04:45:53Z","title":"OPT-Tree: Speculative Decoding with Adaptive Draft Tree Structure","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17276","snapshot_observed_at":"2026-08-11T04:25:53.197676Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.197676Z"},"links":{"cited_paper":"/paper/2406.17276","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:dac756d6b4259ae468f03d5e7a48996878931d9476934bb07f68b806387ad2e5","observation_id":"761f9cfc-c42b-4291-a40d-ff1077a8cece","resolution":{"observed_at":"2026-08-11T04:25:53.197676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00859","last_updated":"2024-08-01T21:21:28Z","snapshot_observed_at":"2026-08-13T00:40:24.206311Z","submitted_at":"2024-04-01T02:01:28Z","title":"Do language models plan ahead for future tokens?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00859","snapshot_observed_at":"2026-08-11T04:25:53.201722Z","title":"Morris, and Lionel Levine","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.201722Z"},"links":{"cited_paper":"/paper/2404.00859","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:15f695651a5c701b0f07db2836d45a9c80bde916482eaf581cbccc9f611220de","observation_id":"31b5c3b1-fb0d-4348-8572-06c4d2ce9d81","resolution":{"observed_at":"2026-08-11T04:25:53.201722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.205868Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.205868Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:9c9374bfb062f6ba1175932f23bb28759d17fe547cab71547a9ec92b468f78d1","observation_id":"1df5bd71-5ea6-4c3f-9439-4b6717146ca3","resolution":{"observed_at":"2026-08-11T04:25:53.205868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.209844Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.209844Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:e1b884bcfc2989c249ffeb0975097f62c5b49557a263999a3009938f87f49669","observation_id":"827fcd63-47d6-49c0-bcd1-14cf8a51efcf","resolution":{"observed_at":"2026-08-11T04:25:53.209844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.499990Z","title":null,"venue":null,"work_id":"58bd0ac7-d5a7-4cf5-b3af-1a796fd7acf5","year":2023},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.213878Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:91b1a31996d59b83df77c709e70acb6115d723c3cef62405a49f326168edbe03","observation_id":"cf92a347-df02-46be-901d-6041c1fbdb96","resolution":{"observed_at":"2026-08-11T04:25:53.505031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.217883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.217883Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:515d412784bec0f3afe7fa3f2319fd46d167c5a779e406dfa496f3574f95d267","observation_id":"5c330569-7392-4cb2-a65c-09bc738230dd","resolution":{"observed_at":"2026-08-11T04:25:53.217883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:25:53.223025Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.223025Z"},"links":{"citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:256b6a9223c104ff959d0029a467698071b94e1cb81d9ebe7c0eb880165717e1","observation_id":"880e11ea-3dab-442a-b773-8cdff03dbab0","resolution":{"observed_at":"2026-08-11T04:25:53.223025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-11T04:25:53.227957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T04:25:53.227957Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2412.18910"},"observation_digest":"sha256:302bfb78c85680b810c8d229e6842504f3872398cd86fa854a5adb39a00e671c","observation_id":"e290d290-e620-4a91-8438-2d2bd2d0f52b","resolution":{"observed_at":"2026-08-11T04:25:53.227957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.18910","last_updated":"2024-12-25T13:57:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T23:54:37.393697Z","submitted_at":"2024-12-25T13:57:33Z","title":"AdaEAGLE: Optimizing Speculative Decoding via Explicit Modeling of Adaptive Draft Structures"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 4 inbound Pith citation observations for arXiv:2412.18910."}