{"as_of":"2026-08-15T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08d8c6390494f0d0cc701d75ea2a3ba9acf23bd431d57e68334276d06083fc79","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T20:43:28.734650Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T22:28:20.436274Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T12:44:39.368757Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-08-08T22:28:20.436274Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment.arXiv preprint arXiv:2501.19309,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04557","last_updated":"2025-07-08T05:05:28Z","snapshot_observed_at":"2026-08-14T22:10:51.226312Z","submitted_at":"2025-02-06T23:10:53Z","title":"Speeding up Speculative Decoding via Sequential Approximate Verification","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T22:28:20.436274Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2502.04557"},"observation_digest":"sha256:3c8359a1662aa633ff256daa99e8d199a94c4bbae60466eb906d31e74cb86b91","observation_id":"1bbf85ee-3856-4f48-9473-503cbd0f3d76","resolution":{"observed_at":"2026-08-08T22:28:20.436274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-08-07T14:32:40.716499Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-13T08:40:19.686980Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.716499Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:e8fcb3b53d297f06cc6a76e61c29960f454b64a1551276597af124b45d7c54de","observation_id":"ad526306-0027-4d71-8a2f-400985c13325","resolution":{"observed_at":"2026-08-07T14:32:40.716499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-08-07T11:04:15.672766Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment.arXiv preprint arXiv:2501.19309, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03566","last_updated":"2025-06-04T04:30:30Z","snapshot_observed_at":"2026-08-14T04:46:24.844866Z","submitted_at":"2025-06-04T04:30:30Z","title":"POSS: Position Specialist Generates Better Draft for Speculative Decoding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:15.672766Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2506.03566"},"observation_digest":"sha256:81f579e7ad48b7b40e0a98758ce36b93945028b15af810cc24d4075b8719c0a9","observation_id":"1888de04-2769-408e-b941-e8efb4a61819","resolution":{"observed_at":"2026-08-07T11:04:15.672766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2507.01449","last_updated":"2026-04-29T08:32:18Z","snapshot_observed_at":"2026-08-12T16:50:37.846017Z","submitted_at":"2025-07-02T08:08:30Z","title":"LogitSpec: Accelerating Retrieval-based Speculative Decoding via Next Next Token Speculation","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-19T06:53:02.744567Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2507.01449"},"observation_digest":"sha256:2fd1fbfb21a0181a1489b789073e78b3815dde1d478bef008df9c50fff9ecde7","observation_id":"2c564df3-6203-45b1-8ebc-7fbf0db78e40","resolution":{"observed_at":"2026-05-19T06:57:08.105128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2510.24211","last_updated":"2026-05-05T17:15:37Z","snapshot_observed_at":"2026-08-15T01:17:43.547829Z","submitted_at":"2025-10-28T09:26:27Z","title":"Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T03:20:35.021120Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2510.24211"},"observation_digest":"sha256:1d59613d0aac86a316b0c9690eb7ad8e798f06d5b4c7af4110edb54f237e55e8","observation_id":"6f9c87b5-2a5a-4ec6-963e-c13f54e73fc4","resolution":{"observed_at":"2026-05-18T03:20:48.614868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2511.22972","last_updated":"2026-04-29T12:32:23Z","snapshot_observed_at":"2026-08-13T21:00:47.642271Z","submitted_at":"2025-11-28T08:23:30Z","title":"Training-Free Loosely Speculative Decoding: Accepting Semantically Correct Drafts Beyond Exact Match","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T05:07:11.466066Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2511.22972"},"observation_digest":"sha256:57304e3025dd4e5e2dc55a0a1a7a0e87dbbbebc15ff7aa3ff50922ed12081a5c","observation_id":"c46c2991-c572-4211-b15b-d31f89d9ab5c","resolution":{"observed_at":"2026-05-17T05:09:03.775841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2604.17701","last_updated":"2026-04-20T01:29:56Z","snapshot_observed_at":"2026-08-14T21:02:55.736345Z","submitted_at":"2026-04-20T01:29:56Z","title":"WISV: Wireless-Informed Semantic Verification for Distributed Speculative Decoding in Device-Edge LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T04:33:28.537449Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2604.17701"},"observation_digest":"sha256:a19bbc3ce339ce35e29c6cbc1328d299c8c45ed0dd3e4002de5f9dc3ff65f7dd","observation_id":"8ea66bec-d4a3-4616-9959-a307d3605a9e","resolution":{"observed_at":"2026-05-10T12:25:22.830033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2604.25777","last_updated":"2026-07-04T14:41:02Z","snapshot_observed_at":"2026-08-12T16:48:24.981901Z","submitted_at":"2026-04-28T15:44:50Z","title":"SpecFed: Accelerating Federated LLM Inference with Speculative Decoding and Compressed Transmission","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T15:12:12.450979Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2604.25777"},"observation_digest":"sha256:f0eb9893a54e89f670c62dca60fd0591ecd0f63af2e91bd0fbb5655d7d62bd97","observation_id":"2b2d14f1-f2c0-47f9-bc9a-e7c637bada05","resolution":{"observed_at":"2026-05-12T00:31:17.297396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2605.24793","last_updated":"2026-05-24T00:34:53Z","snapshot_observed_at":"2026-07-31T02:50:56.300059Z","submitted_at":"2026-05-24T00:34:53Z","title":"Beyond the Target: From Imitation to Collaboration in Speculative Decoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T12:38:24.522899Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2605.24793"},"observation_digest":"sha256:e1e0642824155de5a4ee9914ff79157daf90328c2184b0bd042b9d004b05a378","observation_id":"a15d5a44-1014-483b-864b-a95b020f1820","resolution":{"observed_at":"2026-06-30T12:44:39.370575Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":"2501.19309","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-06-30T12:44:39.368757Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":"1cdf4e38-d629-41ee-9444-b454e3627d58","year":2024},"citing_paper":{"arxiv_id":"2605.29727","last_updated":"2026-05-28T10:21:34Z","snapshot_observed_at":"2026-08-14T09:22:35.528617Z","submitted_at":"2026-05-28T10:21:34Z","title":"Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:11.662084Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2605.29727"},"observation_digest":"sha256:195e09a20c353e0e8c05310bb3915a9a3e46c00c5a781063e9a780867b452757","observation_id":"33de48c3-9d25-490a-b53f-f169bdebecc4","resolution":{"observed_at":"2026-06-29T08:53:15.829133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-07-14T10:09:31.872801Z","title":"Tianle Cai, Yuhong Li, Zhengyang Geng, Hongwu Peng, Jason D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10661","last_updated":"2026-07-12T09:10:34Z","snapshot_observed_at":"2026-08-14T15:46:18.109969Z","submitted_at":"2026-07-12T09:10:34Z","title":"Unlocking Parallelism in Autoregressive Language Models via Speculative Decoding with Progressive Tree Drafting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T10:09:31.872801Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2607.10661"},"observation_digest":"sha256:2e274748407d11ace387b699a718e0d51c1871486619b179c8098873b11efde7","observation_id":"108b1706-daa3-4a9c-8c42-c3313cd2b39a","resolution":{"observed_at":"2026-07-14T10:09:31.872801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-08-01T06:43:34.620346Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment.arXiv preprint arXiv:2501.19309, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21804","last_updated":"2026-07-23T20:42:41Z","snapshot_observed_at":"2026-08-15T05:01:01.412939Z","submitted_at":"2026-07-23T20:42:41Z","title":"Adversarial Prompts for Acceptance Collapse in Speculative Decoding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T06:43:34.620346Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2607.21804"},"observation_digest":"sha256:9a78ce9711b854161bc79d2146e4a623dd5213c396cb4fb918234a0248a965bf","observation_id":"1cf89e8e-1fce-429d-825a-2b827c7bd4e8","resolution":{"observed_at":"2026-08-01T06:43:34.620346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.19309/citation-record","integrity":"/paper/2501.19309/integrity","json":"/paper/2501.19309/citation-record.json","paper":"/paper/2501.19309"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-10T14:07:02.234322Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-09T20:43:27.519350Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.519350Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:c32e643f5479f0af10a2f661ddd544c5685e1c7af3096a9fc2cbfe2e53f30cb8","observation_id":"4085d09d-d9cd-4446-92c1-c8f5c776d3c1","resolution":{"observed_at":"2026-08-09T20:43:27.519350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-14T23:09:03.763342Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-09T20:43:27.524309Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.524309Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:6130135b44ae92f6d144d308e7ed8f365cfd60b9a8f4f47360eb7e1ea0ab363a","observation_id":"ff6e64dc-7880-481d-bb8e-ca5b7fe73c9e","resolution":{"observed_at":"2026-08-09T20:43:27.524309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:27.528271Z","title":"The pitfalls of next-token prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.528271Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:006c3e03f906ef36e2baab37b90cfb74a5996b7a2008bb226ea4866cb4549747","observation_id":"10b50b8f-8441-4d9e-b29f-1bbe6c521c1a","resolution":{"observed_at":"2026-08-09T20:43:27.528271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-08-14T13:58:54.414220Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-09T20:43:27.532056Z","title":"Speculative streaming: Fast llm inference without auxiliary models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.532056Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:63ae87659e7cee935f9d204060572f5f70f0e0c85896d8daccf3a71fbc5c6696","observation_id":"55c28658-f78e-4556-8a76-5f94d086f314","resolution":{"observed_at":"2026-08-09T20:43:27.532056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:27.535887Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.535887Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:d3177f9daad9b9bb2e8a53303d308a603854a0ffd6d23a150d8354e1721e27a5","observation_id":"87170062-8f58-4cac-8d72-1a3eaf5812d3","resolution":{"observed_at":"2026-08-09T20:43:27.535887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-09T20:43:27.551801Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.551801Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:43c98f87d5903893793643eed13292b19aa56addf3f9ede7e894b973b9f96a3e","observation_id":"c876d3d8-4df1-48fa-8efc-3aded5acc9e1","resolution":{"observed_at":"2026-08-09T20:43:27.551801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-09T20:43:27.610251Z","title":"Accelerating large language model decoding with speculative sampling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.610251Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:a579faa3c30cbcb8b9711960d482900a751520aedf0300cce00149718965e665","observation_id":"16e0a974-5bd9-448f-abcf-37e93b414229","resolution":{"observed_at":"2026-08-09T20:43:27.610251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T20:43:27.650005Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.650005Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:a556e0333e682c7b847c9fa2b3d2c2c0662b429bf73fe0d82e5b083cde562faa","observation_id":"1db3e9d4-6718-4a8c-ad6a-189272ad76f0","resolution":{"observed_at":"2026-08-09T20:43:27.650005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-13T04:15:09.481659Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-09T20:43:27.709855Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.709855Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:cc0046b717c5c7df39bb55054fcaa451bdb1b96cad9ff6884dfc63631e5f345f","observation_id":"ca67f8bb-bea2-4a3b-84c2-8dc99c3db2fc","resolution":{"observed_at":"2026-08-09T20:43:27.709855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05636","last_updated":"2025-02-10T20:51:18Z","snapshot_observed_at":"2026-08-12T23:05:29.972966Z","submitted_at":"2024-08-10T21:24:25Z","title":"Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05636","snapshot_observed_at":"2026-08-09T20:43:27.756947Z","title":"Speculative diffusion decoding: Accelerating language generation through diffusion, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.756947Z"},"links":{"cited_paper":"/paper/2408.05636","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:be84983eb28c19fc83327a03ec7598802ff0575fb275978edee396af3b6731f8","observation_id":"190d0c23-5cdd-4d64-b8a4-98a542289930","resolution":{"observed_at":"2026-08-09T20:43:27.756947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-09T20:43:27.836353Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.836353Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:2c139ef4ce065cdc5d0046e76b59e51582792247b88662665e7884b31006616f","observation_id":"c298ae2c-7085-4a43-8f2c-a299f3ff56e6","resolution":{"observed_at":"2026-08-09T20:43:27.836353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T20:43:27.879057Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.879057Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:5cec30f534cf6f60dd06b1aa4e6b43c5bf120d712b0ad696ba9d93802b1c788f","observation_id":"3999321b-6dda-48b1-bba5-c849863cc8bc","resolution":{"observed_at":"2026-08-09T20:43:27.879057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.819118Z","title":"Glide with a ca PE : A low-hassle method to accelerate speculative decoding","venue":null,"work_id":"ce9f3f76-d4b1-4f57-9790-cf3d832aacf2","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.909643Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:609bba7dbacf63f741a2e2ca7b4b03c4747adc05c2b3b632a0bb07b00637cce2","observation_id":"e45f259b-6e12-40a1-8e16-37b41703cf0c","resolution":{"observed_at":"2026-08-09T20:43:29.822854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-09T20:43:27.939138Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.939138Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:cb1d16adc13a9a36e724706d796e80442b9f15544fcb7603840d533ad6a6c93f","observation_id":"bb0ea73b-95d2-4120-9a12-19e8467f46f6","resolution":{"observed_at":"2026-08-09T20:43:27.939138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.808132Z","title":"L ayer S kip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":"68735748-a3eb-43b9-8954-b231a73b23b4","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.945470Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:bd706d93005e311b0e82fb23b23fa4256f35579877929d23f169df152b3a6fb7","observation_id":"ba4270c6-e57e-4e65-aa96-42bbccb38737","resolution":{"observed_at":"2026-08-09T20:43:29.812069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:27.948547Z","title":"Break the sequential dependency of LLM inference using lookahead decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.948547Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:37c762b0d0e94344df4a1162e7d7854056bbf62b7fe7f6a89f3880dfa35dfddc","observation_id":"eb551bbe-eef1-45f5-b5dc-1bcec5a7164d","resolution":{"observed_at":"2026-08-09T20:43:27.948547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.791810Z","title":"Better & faster large language models via multi-token prediction","venue":null,"work_id":"933c28b2-7abc-4793-b0a4-6f1e5463c83f","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.951685Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:056211f3c29b1d1c3b21cb5f55637ef3d3a380b7fa0950dc1ee33df00b82a6b3","observation_id":"39c6ac17-c56a-4bf1-ad89-4419a0a2557a","resolution":{"observed_at":"2026-08-09T20:43:29.795489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-09T20:43:27.955146Z","title":"Mamba: Linear-time sequence modeling with selective state spaces, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.955146Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:50daddebcf534865b94d14777c3f20957bcafaf9ae4003bfa1817bbe88789501","observation_id":"3021abbf-f1fd-40b9-a8cb-9690e2669d75","resolution":{"observed_at":"2026-08-09T20:43:27.955146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-14T10:35:42.683947Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-09T20:43:27.959554Z","title":"Language models represent space and time","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.959554Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:fcec00e9be3a33190a51155e00ed0b882230a5703c3dd5d6219b4d783d9e78aa","observation_id":"fd68835e-7fd4-4d86-99c1-f4bfaabc89c9","resolution":{"observed_at":"2026-08-09T20:43:27.959554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:27.963228Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.963228Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:43df0aa35b384220af80dd3d70647737c502ea1bc160af9c819fa797e8e3771c","observation_id":"b31d5634-06d0-4302-be0f-c1fddc30002b","resolution":{"observed_at":"2026-08-09T20:43:27.963228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-09T20:43:27.966094Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.966094Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:114e5e26c68b20963ab3269481ac332fc51a5b2d1e635bd6e8f100484027e19c","observation_id":"31bd3a57-1db6-43b5-9b81-8f0e36b02591","resolution":{"observed_at":"2026-08-09T20:43:27.966094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19715","last_updated":"2025-07-11T01:33:18Z","snapshot_observed_at":"2026-08-14T04:43:39.905676Z","submitted_at":"2024-05-30T05:49:38Z","title":"SpecDec++: Boosting Speculative Decoding via Adaptive Candidate Lengths","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19715","snapshot_observed_at":"2026-08-09T20:43:27.969502Z","title":"Specdec++: Boosting speculative decoding via adaptive candidate lengths, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.969502Z"},"links":{"cited_paper":"/paper/2405.19715","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:fbb715e01e654c623986db55cf4e4f86a59114440c966f4d1323ebe712c26a55","observation_id":"0af5de14-086b-4b91-b057-27e1ecdf9258","resolution":{"observed_at":"2026-08-09T20:43:27.969502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.732788Z","title":"Data movement is all you need: A case study on optimizing transformers","venue":null,"work_id":"bd363043-d6f3-4bfa-a2cb-1616989b387f","year":2021},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.972616Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:78d998f8fd894b422c44f2aad28d9f84df62fe02f5a13f3177636092fb91afdf","observation_id":"f977499a-6d5f-448b-aef5-342602f61ca0","resolution":{"observed_at":"2026-08-09T20:43:29.753585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-09T20:43:27.975402Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.975402Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:9992cdbb76855982dd8ae409fffe0d419b1a588b6ebabc3d4f35d618635e094c","observation_id":"02a1b503-4b37-4677-b629-417d672ecc9c","resolution":{"observed_at":"2026-08-09T20:43:27.975402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.689302Z","title":"Mahoney, Amir Gholami, and Kurt Keutzer","venue":null,"work_id":"ec8d8565-ae2b-4adb-8934-c13f88124648","year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.978768Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:b8634a4357e5c3cdf526fe27cb0f9739f0beabdfc374b65920e77d8161f9cf3c","observation_id":"bfff92e5-596d-4181-b9cc-989ba1f5d2f9","resolution":{"observed_at":"2026-08-09T20:43:29.709939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.652748Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"c1e0faa8-9d6a-4cc6-802b-938fe62155fd","year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.982927Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:ddd8a0b0d3a33c17c87ff8da665ba9cfd1bf33c74178c9baa427e691d3184c8b","observation_id":"e708a928-0446-42db-ab6d-f6f6d976d42c","resolution":{"observed_at":"2026-08-09T20:43:29.667175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.596953Z","title":"Eagle: Speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":"2360e20a-5256-44c7-9229-f62eebef6f81","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.985984Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:7a92d7f9ce24e8d760f494f6d5db5d4019811f01530972bb2bd4ad36e98bdb52","observation_id":"abcaca6a-ddd8-4af9-b121-d05ff2e181c5","resolution":{"observed_at":"2026-08-09T20:43:29.626812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16858","last_updated":"2024-06-30T15:03:25Z","snapshot_observed_at":"2026-08-13T18:09:06.904816Z","submitted_at":"2024-06-24T17:59:11Z","title":"EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16858","snapshot_observed_at":"2026-08-09T20:43:27.989780Z","title":"Eagle-2: Faster inference of language models with dynamic draft trees, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.989780Z"},"links":{"cited_paper":"/paper/2406.16858","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:507bb15e536da35089909708c3796d3ff650a3fad2bb62d1ad84674bd97fb77d","observation_id":"261d9423-7a29-4b63-bf29-58f284d4ae6f","resolution":{"observed_at":"2026-08-09T20:43:27.989780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18911","last_updated":"2024-04-29T17:53:54Z","snapshot_observed_at":"2026-08-13T00:19:14.097200Z","submitted_at":"2024-04-29T17:53:54Z","title":"Kangaroo: Lossless Self-Speculative Decoding via Double Early Exiting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18911","snapshot_observed_at":"2026-08-09T20:43:27.993414Z","title":"Kangaroo: Lossless self-speculative decoding via double early exiting, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.993414Z"},"links":{"cited_paper":"/paper/2404.18911","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:756c478fa4fc75506037b258c3b4a44a8bd12a22fdaf0c22e2886a690d1663d8","observation_id":"8772975c-3958-4b1b-a578-ac2f2a40cc9d","resolution":{"observed_at":"2026-08-09T20:43:27.993414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.586320Z","title":"Speculative decoding via early-exiting for faster LLM inference with T hompson sampling control mechanism","venue":null,"work_id":"925d56a3-4841-4cb0-8931-2cc0997de54e","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.996795Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:534b3976605064a7bf8379b940dee58ac9e698ba367f29b03f4256c52bf3f91f","observation_id":"e0205688-5e0c-441e-bfec-f1352adf9268","resolution":{"observed_at":"2026-08-09T20:43:29.590110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11850","last_updated":"2025-02-17T03:33:50Z","snapshot_observed_at":"2026-08-12T23:04:27.100022Z","submitted_at":"2024-08-13T08:32:06Z","title":"PEARL: Parallel Speculative Decoding with Adaptive Draft Length","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11850","snapshot_observed_at":"2026-08-09T20:43:27.999754Z","title":"Parallel speculative decoding with adaptive draft length, 2024 c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:27.999754Z"},"links":{"cited_paper":"/paper/2408.11850","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:4d8c409e4f3d1c565f7fc7f07acc33ee3f1c239e653d2658f1ac8fab2f54ab78","observation_id":"fed1400d-ee3d-4922-9a7b-9836d09322d5","resolution":{"observed_at":"2026-08-09T20:43:27.999754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07177","last_updated":"2024-06-10T01:36:31Z","snapshot_observed_at":"2026-08-13T10:57:16.489873Z","submitted_at":"2023-10-11T04:03:42Z","title":"Online Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07177","snapshot_observed_at":"2026-08-09T20:43:28.003596Z","title":"Online speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.003596Z"},"links":{"cited_paper":"/paper/2310.07177","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:7e21fb8f0e50fad57a0828cad23c80849e4fa81f5887b080577bff25d6cac609","observation_id":"f3d2788b-de83-4c00-a3cf-05338503fec7","resolution":{"observed_at":"2026-08-09T20:43:28.003596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.054690Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.054690Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:ebf8bbbaba622292a7f28f1b8dad1a4c6a66082f57f2db29a2d8b439711c83bc","observation_id":"b7ae0ba1-fcfd-46d4-a896-599cfa787bc6","resolution":{"observed_at":"2026-08-09T20:43:28.054690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.140995Z","title":"Specinfer: Accelerating large language model serving with tree-based speculative inference and verification","venue":null,"work_id":"693e80f0-0351-482a-b6e5-39eeaad5d7be","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.105162Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:9cf7b29179ba8288f6a84fc78a34f33c4abdc06b6c66967fba9c4d6c57b68a65","observation_id":"d1a7d43c-d04b-4852-b709-a9625c8da2c6","resolution":{"observed_at":"2026-08-09T20:43:29.185262Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13581","last_updated":"2023-11-22T18:37:27Z","snapshot_observed_at":"2026-08-14T03:06:36.145742Z","submitted_at":"2023-11-22T18:37:27Z","title":"PaSS: Parallel Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13581","snapshot_observed_at":"2026-08-09T20:43:28.177798Z","title":"Pass: Parallel speculative sampling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.177798Z"},"links":{"cited_paper":"/paper/2311.13581","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:701c016d466f23915d0c7951a4b71546aaba0c4449bfb7147727c9b6e07a5b28","observation_id":"725bbda9-89f9-4ac5-aa56-606694e8d046","resolution":{"observed_at":"2026-08-09T20:43:28.177798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.570078Z","title":"Llama 3.1 performance with medusa","venue":null,"work_id":"78c01e88-adf5-4352-8e10-a774f2b9d6ea","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.293859Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:aef3a0f5a0656e4647a9d3663ba609ac02600ab3138ddc597c8a9b1df2177873","observation_id":"60479fae-7488-42c3-a4c2-2e61457f356a","resolution":{"observed_at":"2026-08-09T20:43:29.573670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.387784Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.387784Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:b13377ce531415c2fa6b2c5976181090a92dd8b0f249e1e688d0a9c0df6060b8","observation_id":"ec58d14a-6e57-41cc-8a3a-09120d18eca4","resolution":{"observed_at":"2026-08-09T20:43:28.387784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.438304Z","title":"Efficiently scaling transformer inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.438304Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:7f655e4c1d1b694887bc7a61cd8f770bb15d92972c625249b249a7ef5fc20ef0","observation_id":"2cb80fcc-ddcb-42f0-86ab-b5edae073651","resolution":{"observed_at":"2026-08-09T20:43:28.438304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.546978Z","title":"gpt-fast","venue":null,"work_id":"12eb441b-49ba-4e7a-9de5-8e4995f1d917","year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.467066Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:17352a6064db6be43fa691c6a68b1674790c3e7ce98f706b787d9576fb05bef4","observation_id":"abc45cca-d3dd-4a57-bdef-27af896d9ff6","resolution":{"observed_at":"2026-08-09T20:43:29.550639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.473110Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.473110Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:e653af321d0823e0e432b46667c999e5c47eecdb8e10cafda5a94bd75c63cf68","observation_id":"473d1100-7038-4988-a4e2-c067c5e5c736","resolution":{"observed_at":"2026-08-09T20:43:28.473110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.530242Z","title":"Tandem transformers for inference efficient LLM s","venue":null,"work_id":"dc8a28ac-5cd3-4d95-b5f6-0cc78dc32e82","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.477671Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:71e28d10341a0872be3988e2c68dde2db783d7691b95ec78de0b90bb26be3aa7","observation_id":"5e1a98bc-3ffd-4de5-9ae5-2d0ababc35ef","resolution":{"observed_at":"2026-08-09T20:43:29.534602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.483794Z","title":"Accelerating transformer inference for translation via parallel decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.483794Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:0710617b3245720788d4abfc58e982b45ff54e59e49017e814331c0e865d49d0","observation_id":"5a1cb4b6-1052-440b-ad5c-e186df94a3e4","resolution":{"observed_at":"2026-08-09T20:43:28.483794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.518603Z","title":"Improving the compositionality of word embeddings","venue":null,"work_id":"21840c43-3d32-4c86-bcd3-5c9777c3a143","year":2017},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.488540Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:d66390b9a9be46dc13673f3183728920e6bebf8ad9319c9cbaa1d3e5fce00dff","observation_id":"400fe411-f5e9-4910-bb88-ebce362a89a0","resolution":{"observed_at":"2026-08-09T20:43:29.522273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.508259Z","title":"Tran, Yi Tay, and Donald Metzler","venue":null,"work_id":"0ee89848-9bd5-4242-baf4-4566f010a15b","year":2022},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.491614Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:741153ea11dd338a022de50d9cb2301c1106760fa53538b83456bb0110edb929","observation_id":"13641fa4-4ff8-4dba-b738-6703697e8889","resolution":{"observed_at":"2026-08-09T20:43:29.511507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-09T20:43:28.494627Z","title":"Fast transformer decoding: One write-head is all you need, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.494627Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:cdeef2b5dec602c5569ae5a9dd0aeced504486201c27098379930caab3c7e01a","observation_id":"0cfebaf8-d68b-4bf0-8cd2-d408d55bb647","resolution":{"observed_at":"2026-08-09T20:43:28.494627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.497829Z","title":"Shazeer, and Jakob Uszkoreit","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.497829Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:91992ca3f52ff52f70f186a40a8aed36cf8cad92e7cb94f3c01e85e7ef94946c","observation_id":"350c8e18-f0d9-42cd-913f-87378f3e4861","resolution":{"observed_at":"2026-08-09T20:43:28.497829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.500724Z","title":"Instantaneous grammatical error correction with shallow aggressive decoding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.500724Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:00e6a219595f71b91b17454771b32b4cb4fba67a0bd81b02cdff706ae6da426c","observation_id":"bc9aaf7a-57f2-4909-bbab-b66667f2e910","resolution":{"observed_at":"2026-08-09T20:43:28.500724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.504394Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.504394Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:82da3d850273e4ce1fb40c6387b213d5b59f44767fb32c3e7dcd21717051ef46","observation_id":"718cc568-f13e-4b7e-9d39-bbbeb7a34424","resolution":{"observed_at":"2026-08-09T20:43:28.504394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08516","last_updated":"2024-06-04T10:25:13Z","snapshot_observed_at":"2026-08-13T05:25:16.917606Z","submitted_at":"2023-11-14T20:12:38Z","title":"LLMs cannot find reasoning errors, but can correct them given the error location","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08516","snapshot_observed_at":"2026-08-09T20:43:28.507471Z","title":"Llms cannot find reasoning errors, but can correct them given the error location, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.507471Z"},"links":{"cited_paper":"/paper/2311.08516","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:0c53ed0ac617d70296bd26e500fa5f46e7e2025eccce8358e9d8c6c97f223e93","observation_id":"204da08b-2e9e-4956-8776-8b5c5670221a","resolution":{"observed_at":"2026-08-09T20:43:28.507471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14433","last_updated":"2024-02-22T10:25:14Z","snapshot_observed_at":"2026-08-13T04:13:01.483044Z","submitted_at":"2024-02-22T10:25:14Z","title":"A Language Model's Guide Through Latent Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14433","snapshot_observed_at":"2026-08-09T20:43:28.511350Z","title":"A language model's guide through latent space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.511350Z"},"links":{"cited_paper":"/paper/2402.14433","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:4bafe796151fb0f951fdf7e0b379268368949f92724d4144d01dba05c2cffa74","observation_id":"f7c6d8c8-439b-4aff-b871-54f52da772a6","resolution":{"observed_at":"2026-08-09T20:43:28.511350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15237","last_updated":"2025-06-27T07:54:57Z","snapshot_observed_at":"2026-08-12T22:56:24.705800Z","submitted_at":"2024-08-27T17:56:11Z","title":"The Mamba in the Llama: Distilling and Accelerating Hybrid Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15237","snapshot_observed_at":"2026-08-09T20:43:28.514872Z","title":"Rush, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.514872Z"},"links":{"cited_paper":"/paper/2408.15237","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:65037a4db8c23af7998d14ffe6efa7435965ccfd8371202838e1b2dae5d6f104","observation_id":"0bf13d17-b035-4d0e-b085-97a300260310","resolution":{"observed_at":"2026-08-09T20:43:28.514872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19124","last_updated":"2024-06-06T18:38:34Z","snapshot_observed_at":"2026-08-13T00:19:04.418458Z","submitted_at":"2024-04-29T21:59:07Z","title":"Accelerating Production LLMs with Combined Token/Embedding Speculators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19124","snapshot_observed_at":"2026-08-09T20:43:28.518610Z","title":"Accelerating production llms with combined token/embedding speculators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.518610Z"},"links":{"cited_paper":"/paper/2404.19124","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:93c748d74b1b630cdc7035b097477e0ec612b3d8a09288d05c30c9fedb436efd","observation_id":"2a0c556c-fcdc-4b3f-9cf1-b600e05fe148","resolution":{"observed_at":"2026-08-09T20:43:28.518610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.521974Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.521974Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:0fd5b314e28cde93dcb9442e42565c27e1e669054fc3c3ee3c736d5ee4644557","observation_id":"c29d703e-8352-4dac-b268-cf46e51f4e31","resolution":{"observed_at":"2026-08-09T20:43:28.521974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.524767Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.524767Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:995b9814c643a423bf74b45ab78abdeebe7b59022ebb6d23b3f904df763c8c00","observation_id":"40428115-926a-40cf-8062-43eedb9db1aa","resolution":{"observed_at":"2026-08-09T20:43:28.524767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09919","last_updated":"2024-12-13T19:50:19Z","snapshot_observed_at":"2026-08-13T00:53:52.253168Z","submitted_at":"2024-03-14T23:40:56Z","title":"Recurrent Drafter for Fast Speculative Decoding in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09919","snapshot_observed_at":"2026-08-09T20:43:28.528369Z","title":"Recurrent drafter for fast speculative decoding in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.528369Z"},"links":{"cited_paper":"/paper/2403.09919","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:18ebd6f03be70ffddae67cab53f72b4f472362daaf360c87f521456e4426940e","observation_id":"ace799fd-7be1-4cd7-b1d2-00bc560b6dae","resolution":{"observed_at":"2026-08-09T20:43:28.528369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07467","last_updated":"2019-10-16T16:44:22Z","snapshot_observed_at":"2026-08-08T08:22:25.110228Z","submitted_at":"2019-10-16T16:44:22Z","title":"Root Mean Square Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07467","snapshot_observed_at":"2026-08-09T20:43:28.531501Z","title":"Root mean square layer normalization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.531501Z"},"links":{"cited_paper":"/paper/1910.07467","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:517582c5b9e5b466865ec14938d5c48aeb8cfada43c53c32be3b833304c0c2e1","observation_id":"0b0468ba-369f-41a3-ac9f-ce1ead98bce4","resolution":{"observed_at":"2026-08-09T20:43:28.531501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.459183Z","title":"Draft & verify: Lossless large language model acceleration via self-speculative decoding","venue":null,"work_id":"fcc7837d-7a44-464b-b0a9-5ff886bd0358","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.534899Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:c27f50aacdf885827cbea62746c6751157e56e9febf2712f952df73c5a7e4510","observation_id":"7626693c-57c3-4af5-86ed-5f470843f900","resolution":{"observed_at":"2026-08-09T20:43:29.479924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.538446Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.538446Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:4f1c54005a26411fdd994e8eb085f7cbd3d9ad9713c70bfad3346131dd2d0eb9","observation_id":"37833982-fe08-45f2-b94e-0cff7d729ba8","resolution":{"observed_at":"2026-08-09T20:43:28.538446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:29.426261Z","title":"Distillspec: Improving speculative decoding via knowledge distillation","venue":null,"work_id":"3f84745e-59f0-4825-a8ff-3ec8b880a4da","year":2024},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.541874Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:573aa47bf335a29392bca8530c379ec09d5f3ea22d72dd68e9d76d62b78019f6","observation_id":"79a881e5-f4bf-434a-89fd-089bf61636b2","resolution":{"observed_at":"2026-08-09T20:43:29.446153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-09T20:43:28.565306Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.565306Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:a7fd0595b105468a4dbccb28422288d321fc4c295bb90df44eec407647883eee","observation_id":"f0d8bf31-375d-4e86-90df-01217e8b2b3c","resolution":{"observed_at":"2026-08-09T20:43:28.565306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.601479Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.601479Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:771c44cf6b36ee97e4742b0993f3be134d87f9f75664b6918b1f21c7bc6b3b85","observation_id":"624d028e-9ad4-4f15-bf80-7333b461bf48","resolution":{"observed_at":"2026-08-09T20:43:28.601479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.640787Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.640787Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:f3bc5a14bdfac8eb2e525fa83f75d694b50447c5ec8268cb4ebe260713ab552f","observation_id":"85b10665-dda6-4336-a79c-b42103354d49","resolution":{"observed_at":"2026-08-09T20:43:28.640787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.692051Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.692051Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:f1a398e13be9e518708b70af34a718933c8c4609fb8055d541232e616de2b8ca","observation_id":"ba9bbd93-702d-4446-8cab-b6a8d28f87f5","resolution":{"observed_at":"2026-08-09T20:43:28.692051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T20:43:28.734650Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T20:43:28.734650Z"},"links":{"citing_paper":"/paper/2501.19309"},"observation_digest":"sha256:41ac15dd4f88d4aa48fb694270bffb6f12c154d6651b2967e298845330e22d11","observation_id":"8c4be64e-a556-413f-a2d2-2600482e91c6","resolution":{"observed_at":"2026-08-09T20:43:28.734650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T20:59:09.799963Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 12 inbound Pith citation observations for arXiv:2501.19309."}