{"as_of":"2026-08-10T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13d3b4aeb37b30359e42ccd1193418b1f636c33e4f7c870f4858e06022e86a75","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T07:23:20.404741Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02438/citation-record","integrity":"/paper/2608.02438/integrity","json":"/paper/2608.02438/citation-record.json","paper":"/paper/2608.02438"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.343509Z","title":"Accelerating large language model decoding with speculative sampling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.343509Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:0dc0163d9d891c92a2a290c75fc505c882d0ddfb3daff3d4111891ef145de5dd","observation_id":"bb65e14f-356d-438b-aa19-12440cef62cd","resolution":{"observed_at":"2026-08-04T07:23:16.343509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17192","last_updated":"2023-05-18T20:28:20Z","snapshot_observed_at":"2026-08-08T11:03:33.403601Z","submitted_at":"2022-11-30T17:33:28Z","title":"Fast Inference from Transformers via Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17192","snapshot_observed_at":"2026-08-04T07:23:16.465713Z","title":"Fast inference from transformers via speculative decoding.ICML, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.465713Z"},"links":{"cited_paper":"/paper/2211.17192","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:6ad31d5e55bb0d75bb238c22801835fbee32f4a238a66dcfe5a662bed77aa825","observation_id":"31944f9d-4ca3-47cc-8951-8a7e94369236","resolution":{"observed_at":"2026-08-04T07:23:16.465713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-04T07:23:16.584753Z","title":"Eagle: Speculative sampling requires rethinking feature uncertainty.ICML, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.584753Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:5773330740d3c489ccb22dba2dc554d511ab3f54b57a4747eafafe53c356883e","observation_id":"32725374-759c-4c20-857f-61aa21f03727","resolution":{"observed_at":"2026-08-04T07:23:16.584753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.730520Z","title":"Eagle-2: Faster inference of language models with dynamic draft trees, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.730520Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:32f0a4dc4479507a9c31329805dc17f92d1db41e568f329fdac92577abd12d0f","observation_id":"bab3872e-1e6c-40b3-b37c-0a21352a3589","resolution":{"observed_at":"2026-08-04T07:23:16.730520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:16.824759Z","title":"Eagle-3: Scaling up inference acceleration of large language models via training-time test, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.824759Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:3c6f8775b67cabb8e212ed06aa598fe745e76aa525f1c42f677898e7ca734789","observation_id":"87913380-dfdd-41d6-a51e-4a97d936ef52","resolution":{"observed_at":"2026-08-04T07:23:16.824759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.06036","last_updated":"2026-05-28T09:13:25Z","snapshot_observed_at":"2026-08-03T04:09:50.707111Z","submitted_at":"2026-02-05T18:59:30Z","title":"DFlash: Block Diffusion for Flash Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.06036","snapshot_observed_at":"2026-08-04T07:23:16.944748Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:16.944748Z"},"links":{"cited_paper":"/paper/2602.06036","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a61e00925e86263b4540626a2548a69f04f18375e7b03c393d1b527e874f6b53","observation_id":"9500b7d7-60ff-48d4-83f9-8ef4d409d431","resolution":{"observed_at":"2026-08-04T07:23:16.944748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.094835Z","title":"Fast-dllm v2: Efficient block-diffusion llm, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.094835Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:d626e102496e04824f7fbf893497f8ba3e9ea595c829fd7ee289bfb85f5de73f","observation_id":"a6274d55-a003-4fbd-965d-2eec69bfd038","resolution":{"observed_at":"2026-08-04T07:23:17.094835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.275081Z","title":"Tidar: Think in diffusion, talk in autoregression, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.275081Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:3698129ac389a1c4194d50b4d3643a9ad9326736c1c5a3963f81ce3235f80ded","observation_id":"d5a673b1-4fe0-4ed5-a21d-024c4097561c","resolution":{"observed_at":"2026-08-04T07:23:17.275081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.364765Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.364765Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:0823bf1cf8b654ba28f14163b3628e46827c58a6e480caab4732f09574d8b76b","observation_id":"8f9412a3-5d1e-4f12-a11d-921a3d042750","resolution":{"observed_at":"2026-08-04T07:23:17.364765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12989","last_updated":"2026-04-14T17:23:14Z","snapshot_observed_at":"2026-08-06T01:59:43.470767Z","submitted_at":"2026-04-14T17:23:14Z","title":"Accelerating Speculative Decoding with Block Diffusion Draft Trees","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12989","snapshot_observed_at":"2026-08-04T07:23:17.415736Z","title":"Ringel and Y","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.415736Z"},"links":{"cited_paper":"/paper/2604.12989","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:d1a98eee9ae1cdb8a638c3746050eb324fdcf6a9e3b52de2501dac7089e4b22c","observation_id":"25a4b97a-1c19-4eb4-afa4-1efb1894225e","resolution":{"observed_at":"2026-08-04T07:23:17.415736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.545685Z","title":"Diffuspec: Unlocking diffusion language models for speculative decoding, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.545685Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:49e91caafcf8ef3c963ff34f7ed01af8b1ac5f1221a2cff5e8c46ae26ace4f3e","observation_id":"c73768be-6966-4ba4-8e26-a1345a41f704","resolution":{"observed_at":"2026-08-04T07:23:17.545685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:17.804761Z","title":"Christopher, Thomas Hartvigsen, and Ferdinando Fioretto","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:17.804761Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:2e19d779f0de0c87d253627263e0aab73c85c9550fdd3d4385edd3191927a10e","observation_id":"83864740-ff5e-4fbb-b97b-02e6685a7bb2","resolution":{"observed_at":"2026-08-04T07:23:17.804761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.014750Z","title":"Nemotron-labs-diffusion: A tri-mode language model unifying autoregressive, diffusion, and self-speculation decoding, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.014750Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:e805d9e811c8c45fbc41f3b71ca95d0b094f6434093f29d61ae369f6e5d771de","observation_id":"7ec57304-d725-4159-8917-dfa8b34ec191","resolution":{"observed_at":"2026-08-04T07:23:18.014750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.154780Z","title":"Jetspec: Breaking the scaling ceiling of speculative decoding with parallel tree drafting, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.154780Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:6f5841ad4a6df68cc6c4036db198657ac1437643787739407c7afb50df1798f2","observation_id":"081a25d9-63f9-47e2-a219-cde9a98e18c1","resolution":{"observed_at":"2026-08-04T07:23:18.154780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29707","last_updated":"2026-05-28T10:07:44Z","snapshot_observed_at":"2026-08-02T05:37:29.736109Z","submitted_at":"2026-05-28T10:07:44Z","title":"Domino: Decoupling Causal Modeling from Autoregressive Drafting in Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29707","snapshot_observed_at":"2026-08-04T07:23:18.317159Z","title":"Domino: Decoupling causal modeling from autoregressive drafting in speculative decoding","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.317159Z"},"links":{"cited_paper":"/paper/2605.29707","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:237179a38a713b9d93c9356cb75233997015496941bf396edadfabfff155ac2f","observation_id":"1800b6d9-bb29-45de-944e-bc5b6344f08f","resolution":{"observed_at":"2026-08-04T07:23:18.317159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05147","last_updated":"2026-07-06T14:28:06Z","snapshot_observed_at":"2026-07-31T15:07:06.604191Z","submitted_at":"2026-07-06T14:28:06Z","title":"DSpark: Confidence-Scheduled Speculative Decoding with Semi-Autoregressive Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05147","snapshot_observed_at":"2026-08-04T07:23:18.474757Z","title":"Cheng, X","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.474757Z"},"links":{"cited_paper":"/paper/2607.05147","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a56c25307d0b6400eebb0a58a40acc3a84f57f0d2b168695bb341b7e8d9b326b","observation_id":"49c8122c-c595-4953-9ec2-72d46d1b47e2","resolution":{"observed_at":"2026-08-04T07:23:18.474757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09969","last_updated":"2026-05-11T04:20:04Z","snapshot_observed_at":"2026-08-02T06:56:43.284236Z","submitted_at":"2026-05-11T04:20:04Z","title":"The Truth Lies Somewhere in the Middle (of the Generated Tokens)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09969","snapshot_observed_at":"2026-08-04T07:23:18.614803Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.614803Z"},"links":{"cited_paper":"/paper/2605.09969","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:97401f033fc26424f17ae5cc8b045948bdce02660914e103c4e64f0ab98edd73","observation_id":"22e65202-db4c-442a-9f02-53624738ddf8","resolution":{"observed_at":"2026-08-04T07:23:18.614803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03629","last_updated":"2021-06-11T21:44:07Z","snapshot_observed_at":"2026-08-08T22:33:32.614060Z","submitted_at":"2020-02-10T10:11:31Z","title":"Accelerating Feedforward Computation via Parallel Nonlinear Equation Solving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03629","snapshot_observed_at":"2026-08-04T07:23:18.764751Z","title":"Accelerating feedforward compu- tation via parallel nonlinear equation solving.ICML, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.764751Z"},"links":{"cited_paper":"/paper/2002.03629","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:1e454e9b2839220668072b182500084107b6aee5cb9ffb4858c4ddd6398c68d9","observation_id":"229b6f30-b25d-4a83-b361-9cc9ffd72b07","resolution":{"observed_at":"2026-08-04T07:23:18.764751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:18.914754Z","title":"Santilli et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:18.914754Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:270b6685c4402704cc534001990515ace547dca26a40910c73d559f0b427a43f","observation_id":"bf6a6bdf-4d20-427b-98c3-30e88ca4fd79","resolution":{"observed_at":"2026-08-04T07:23:18.914754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00835","last_updated":"2024-06-13T08:41:28Z","snapshot_observed_at":"2026-08-09T21:40:29.985039Z","submitted_at":"2024-02-28T20:17:04Z","title":"CLLMs: Consistency Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00835","snapshot_observed_at":"2026-08-04T07:23:19.084749Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.084749Z"},"links":{"cited_paper":"/paper/2403.00835","citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:9f068d758df74faf564155775e5b7c18a5ec47c57153602380e94fd40e9ced03","observation_id":"5ba658f3-2ebc-425f-b402-20624caf23cb","resolution":{"observed_at":"2026-08-04T07:23:19.084749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.233730Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.233730Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:6b16c1530d3daf51632a462b2b63083f92dee93fd8af0535d500e63f3053d39a","observation_id":"94570b0a-d1cf-4371-bd4c-265e0972858d","resolution":{"observed_at":"2026-08-04T07:23:19.233730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.414749Z","title":"The perfect blend: Redefining rlhf with mixture of judges, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.414749Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:0038d54562581b3eb38767b1a12c7a2f93382429ffa506dfd7e172be8e8d9d23","observation_id":"9ecb00e8-f39a-4fac-82fa-d565069f2a9b","resolution":{"observed_at":"2026-08-04T07:23:19.414749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.574748Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.574748Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:a3a3c623ae089f8cc34202d324518e2b30e5bf6f928c27b731949e07bffd872a","observation_id":"42971fdd-1f8e-4af2-9753-7de2c8f48e3e","resolution":{"observed_at":"2026-08-04T07:23:19.574748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.724749Z","title":"Let’s verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.724749Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:42acbd7e650a36a8973378eaff09c6e45fd4ae99f890ed6608547d95f052e396","observation_id":"2e50b42e-a483-4c63-b0cc-5b7f867046e4","resolution":{"observed_at":"2026-08-04T07:23:19.724749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.855175Z","title":"American invitational mathematics examination (aime).https://maa.org/ math-competitions/aime","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.855175Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:96e69696e1e278f12b5f4faee6512315ae8c034cc644a3f8e25ae603653f49fa","observation_id":"7b526c6f-b669-4162-abc3-4f074525c0ac","resolution":{"observed_at":"2026-08-04T07:23:19.855175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:19.936741Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:19.936741Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:4e834f81a7f6535e59ca23ecf057e4a14b40059a350315ebcd2d89e94c988de2","observation_id":"24e21f02-9219-47ec-b631-348b350716cb","resolution":{"observed_at":"2026-08-04T07:23:19.936741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.087246Z","title":"Programsynthesis with large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.087246Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:98242eea331e05d7c12c4cab45936c8be51ad5cc57b7b28cf6b35ef1931434bc","observation_id":"f5be1667-749c-4018-a43c-f4d2c21867fb","resolution":{"observed_at":"2026-08-04T07:23:20.087246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.186333Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.186333Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:14b357513e7cb41ed1b43b23a0b8af9414aff782e972abf975359aa824e74612","observation_id":"95e6b52d-23b3-47ce-a150-9ff74601c6ac","resolution":{"observed_at":"2026-08-04T07:23:20.186333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.320115Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.320115Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:8902da7b3e2f35168ae2be27ebb040dc1cf3d54e57d32d57332ea5cd56e44c1a","observation_id":"49cab41b-d5fc-432f-aa59-dab035996870","resolution":{"observed_at":"2026-08-04T07:23:20.320115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T07:23:20.404741Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:20.404741Z"},"links":{"citing_paper":"/paper/2608.02438"},"observation_digest":"sha256:f7d8131e2d735e11f54d44825bff5c03d46ab21a7e818d9c203d2906c64b5e7e","observation_id":"391b8900-4ad8-4306-8974-cd95a203c7b9","resolution":{"observed_at":"2026-08-04T07:23:20.404741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02438","last_updated":"2026-08-03T16:18:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T06:27:40.003406Z","submitted_at":"2026-08-03T16:18:22Z","title":"xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2608.02438."}