{"as_of":"2026-08-18T12:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2d5357811331a81c3b1312a90f7c7723484c14d5ea49908ca4d752055d9627cf","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:24:24.094888Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:34:06.349721Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T03:07:50.848023Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2601.21708","last_updated":"2026-04-08T10:39:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T13:39:55Z","title":"FBS: Modeling Native Parallel Reading inside a Transformer","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T10:08:58.909235Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2601.21708"},"observation_digest":"sha256:d21b1527562f6d879e941d3c37f8a59bd48f092a57c835abb7277735064b6804","observation_id":"d68a7524-23b3-42fb-b0b3-58a9ea008986","resolution":{"observed_at":"2026-05-16T10:10:49.586949Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2605.07243","last_updated":"2026-05-21T16:49:20Z","snapshot_observed_at":"2026-08-16T12:38:42.049714Z","submitted_at":"2026-05-08T04:59:48Z","title":"SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T02:27:45.880587Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2605.07243"},"observation_digest":"sha256:c0dcca944327c2fbc8af39fb2e10d005060443e3d0693c2cca544b7775e4f1cf","observation_id":"d6a77978-d09e-420d-839c-587ce9946318","resolution":{"observed_at":"2026-05-11T03:30:57.288445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2605.07243","last_updated":"2026-05-21T16:49:20Z","snapshot_observed_at":"2026-08-16T12:38:42.049714Z","submitted_at":"2026-05-08T04:59:48Z","title":"SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T10:49:25.448580Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2605.07243"},"observation_digest":"sha256:a81914f99f9fefac335f897f2a064f3aac3e57efc2993ee287b2a8489c5496e7","observation_id":"b3a05227-5af0-4b15-9c2c-2744aebc144c","resolution":{"observed_at":"2026-05-22T10:51:26.093051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2605.12825","last_updated":"2026-05-17T06:15:57Z","snapshot_observed_at":"2026-08-02T22:38:42.397013Z","submitted_at":"2026-05-12T23:47:35Z","title":"Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T19:49:16.478833Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2605.12825"},"observation_digest":"sha256:870ac2cb25de4fd03226750f79354f52c751fd38ac261f1fd040d3937e471df2","observation_id":"3cdd3e8a-bd26-46ec-8f35-0ee15c6b492b","resolution":{"observed_at":"2026-05-14T19:49:25.460646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2605.12825","last_updated":"2026-05-17T06:15:57Z","snapshot_observed_at":"2026-08-02T22:38:42.397013Z","submitted_at":"2026-05-12T23:47:35Z","title":"Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T21:37:58.464075Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2605.12825"},"observation_digest":"sha256:96975736090a46006cf0e9da550ee7e091d246a296fac2d2fae691270d6cb53f","observation_id":"bf0bf903-3094-43c7-b3b3-ea60449411ec","resolution":{"observed_at":"2026-05-20T21:39:03.422163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2607.01775","last_updated":"2026-07-02T06:45:43Z","snapshot_observed_at":"2026-08-05T08:13:48.395073Z","submitted_at":"2026-07-02T06:45:43Z","title":"Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-07-03T17:30:39.458521Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2607.01775"},"observation_digest":"sha256:1a150de9dadbfb13baaeb161c65c2d847dc8732e5af5ee8765b5a33dec9676f0","observation_id":"fa178609-9115-40ef-805f-6e0ef6443eb1","resolution":{"observed_at":"2026-07-03T17:38:43.624407Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":"2509.04185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-07-11T03:07:50.848023Z","title":"Set block decoding is a language model inference accelerator","venue":"cs.LG","work_id":"78d65102-c65d-4768-a6df-89a39e96c873","year":2025},"citing_paper":{"arxiv_id":"2607.05722","last_updated":"2026-07-07T01:09:54Z","snapshot_observed_at":"2026-08-06T13:45:31.949136Z","submitted_at":"2026-07-07T01:09:54Z","title":"Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-11T03:04:12.500342Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2607.05722"},"observation_digest":"sha256:afb2e8726b58b20c85042dc2b29b724ce7f2973b931f052ea100653a35498b5e","observation_id":"3f5f3e84-605e-4c12-8990-46a676ca3356","resolution":{"observed_at":"2026-07-11T03:07:50.879251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04185","snapshot_observed_at":"2026-08-01T07:34:06.349721Z","title":"Set block decoding is a language model inference accelerator.arXiv preprint arXiv:2509.04185, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21427","last_updated":"2026-07-23T15:29:49Z","snapshot_observed_at":"2026-08-10T17:30:46.198156Z","submitted_at":"2026-07-23T15:29:49Z","title":"Context-weighted Discrete Flow Matching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T07:34:06.349721Z"},"links":{"cited_paper":"/paper/2509.04185","citing_paper":"/paper/2607.21427"},"observation_digest":"sha256:6c9dc062c227a95bda89219b5cf6a9c50a5ed12d3de1a58aeed4980c37d850a2","observation_id":"d2499422-02d1-44cb-9f5e-b2809416334e","resolution":{"observed_at":"2026-08-01T07:34:06.349721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04185/citation-record","integrity":"/paper/2509.04185/integrity","json":"/paper/2509.04185/citation-record.json","paper":"/paper/2509.04185"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-05T10:24:23.995181Z","title":"Program synthesis with large language models.arXiv preprint arXiv:2108.07732 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:23.995181Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:14e372f69e727867f882de55846151f84b6ee640bdbd69401ecaea050f88ca08","observation_id":"a0cfe951-4b89-4f31-ad3e-1f7faba799c7","resolution":{"observed_at":"2026-08-05T10:24:23.995181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-08-17T10:13:54.763177Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-05T10:24:24.004164Z","title":"Medusa: Simple llm inference acceleration framework with multiple decoding heads.arXiv preprint arXiv:2401.10774 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.004164Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:b62120d9255f67dcdf960d23750cf7bc618c8d6925859370862fd306697ec21e","observation_id":"c21f9036-f0ca-48ac-b536-642e90592da7","resolution":{"observed_at":"2026-08-05T10:24:24.004164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.023323Z","title":"Itai Gat, Tal Remez, Neta Shaul, Felix Kreuk, Ricky TQ Chen, Gabriel Synnaeve, Yossi Adi, and Yaron Lipman","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.023323Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:93eb434f8464d1007cf1d49f96c6c2bc0d004422d5f110709a8693eb3cbcf74d","observation_id":"452fb77c-8472-4f45-9aa3-cd5696dd3863","resolution":{"observed_at":"2026-08-05T10:24:24.023323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09324","last_updated":"2019-09-04T16:31:39Z","snapshot_observed_at":"2026-08-14T16:43:51.620566Z","submitted_at":"2019-04-19T19:53:01Z","title":"Mask-Predict: Parallel Decoding of Conditional Masked Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09324","snapshot_observed_at":"2026-08-05T10:24:24.027372Z","title":"Mask-predict: Parallel decoding of conditional masked language models","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.027372Z"},"links":{"cited_paper":"/paper/1904.09324","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:9f6a26e1f88debce9d0c9d81e224a4fabbe470b3f07fd8dd5e83a4c42446644e","observation_id":"66efcdca-6acb-4fff-ade8-1e208f92b017","resolution":{"observed_at":"2026-08-05T10:24:24.027372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20639","last_updated":"2025-06-26T15:46:40Z","snapshot_observed_at":"2026-08-17T13:30:15.045823Z","submitted_at":"2025-06-25T17:35:47Z","title":"DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20639","snapshot_observed_at":"2026-08-05T10:24:24.035220Z","title":"Diffucoder: Understanding and improving masked diffusion models for code generation, 2025.https://arxiv.org/ abs/2506.20639","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.035220Z"},"links":{"cited_paper":"/paper/2506.20639","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:5d5dd20d49aa422d561e220c6237d698af4e25bc430e8aee593ac87e8a419c0d","observation_id":"2b0407d5-340d-4d8e-9261-46b063a6af7b","resolution":{"observed_at":"2026-08-05T10:24:24.035220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.038975Z","title":"12 Zhanqiu Hu, Jian Meng, Yash Akhauri, Mohamed S Abdelfattah, Jae-sun Seo, Zhiru Zhang, and Udit Gupta","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.038975Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:2000395b16fd1b23d6f5c8ae725f74730124bbcbbf5e4db429d3f80947ac05c3","observation_id":"95216656-5a0d-431d-b1ca-701fcfcaad2f","resolution":{"observed_at":"2026-08-05T10:24:24.038975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.042519Z","title":"Daniel Israel, Guy Van den Broeck, and Aditya Grover","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.042519Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:651de61a17b92148e042d6235836bdc513a44ff8c8913ee856489fd232cce151","observation_id":"87c79948-962e-4477-ab00-ac52746bdfbb","resolution":{"observed_at":"2026-08-05T10:24:24.042519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T10:24:24.045479Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.045479Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:b83269da91b40191d042af2063e6d69cc252158f81e9b094deb1f8483ed16845","observation_id":"188574ef-1042-4ffe-ae3e-d77315431ad8","resolution":{"observed_at":"2026-08-05T10:24:24.045479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17298","last_updated":"2025-06-17T17:06:18Z","snapshot_observed_at":"2026-08-16T00:24:16.429058Z","submitted_at":"2025-06-17T17:06:18Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17298","snapshot_observed_at":"2026-08-05T10:24:24.048943Z","title":"Mercury: Ultra-fast language models based on diffusion, 2025.https://arxiv.org/abs/2506.17298","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.048943Z"},"links":{"cited_paper":"/paper/2506.17298","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:aa15407d2170d90befafa0663b09c4e38cd4b66d96aa6d5bfef25fd5a5ffad47","observation_id":"177cea2d-a736-4bbf-83c1-f135a130a2e6","resolution":{"observed_at":"2026-08-05T10:24:24.048943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T10:24:24.052717Z","title":"Dimakis, Yair Carmon, Achal Dave, Ludwig Schmidt, and Vaishaal Shankar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.052717Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:ad1773de6b56e3f3fe0f824cf15e13d2ba3135c0e748557685ae445dfd135f64","observation_id":"820faa07-8600-43ff-ac3e-da27f993e155","resolution":{"observed_at":"2026-08-05T10:24:24.052717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.056646Z","title":"Xiaoran Liu, Zhigeng Liu, Zengfeng Huang, Qipeng Guo, Ziwei He, and Xipeng Qiu","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.056646Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:a607c17e910daaa0a104955fd6a036215d8e644320745eeeaa03e4bd60424774","observation_id":"3f30e8ce-dead-437f-9382-4b5456d3359c","resolution":{"observed_at":"2026-08-05T10:24:24.056646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15781","last_updated":"2025-05-21T17:32:10Z","snapshot_observed_at":"2026-08-11T13:17:41.186341Z","submitted_at":"2025-05-21T17:32:10Z","title":"dKV-Cache: The Cache for Diffusion Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15781","snapshot_observed_at":"2026-08-05T10:24:24.060171Z","title":"dkv-cache: The cache for diffusion language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.060171Z"},"links":{"cited_paper":"/paper/2505.15781","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:df651daf4f86775520a26b2771b52a0af53733e66e774998782244fa84e82803","observation_id":"cfd3a2b9-906e-428f-bfa2-e351a926b3e9","resolution":{"observed_at":"2026-08-05T10:24:24.060171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T10:24:24.063836Z","title":"The llama 3 herd of models, 2024.https://arxiv.org/abs/2407.21783","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.063836Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:ac00d4cf7891910e8101e00d3ff6905f003898172f8ba93c0b535f2cbe64d0a7","observation_id":"b06c4811-2a3a-4a1f-a9e7-93420e54231d","resolution":{"observed_at":"2026-08-05T10:24:24.063836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T10:24:24.067099Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.067099Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:c2aef3cd900585d0d5cc83a0fc1fd14e51ae260246a0894e8115125b7f8416f2","observation_id":"e17a48b1-5ac4-430f-9470-989c571abaac","resolution":{"observed_at":"2026-08-05T10:24:24.067099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01928","last_updated":"2026-08-05T00:02:32Z","snapshot_observed_at":"2026-08-16T13:18:35.978275Z","submitted_at":"2025-06-02T17:47:27Z","title":"Esoteric Language Models: A Family of Any-Order Diffusion LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01928","snapshot_observed_at":"2026-08-05T10:24:24.070507Z","title":"Esoteric language models.arXiv preprint arXiv:2506.01928 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.070507Z"},"links":{"cited_paper":"/paper/2506.01928","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:b83e2057b4101b87c6ae27d8a12ac2d0cb74c6a7544a201105c48f912904fd85","observation_id":"c6794250-260a-4039-b08b-6c9401718236","resolution":{"observed_at":"2026-08-05T10:24:24.070507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-16T10:42:13.725165Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-05T10:24:24.074079Z","title":"Winogrande: An adversarial winograd schema challenge at scale.arXiv preprint arXiv:1907.10641 ,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.074079Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:4fda627ea9fb881c318748782184618b0ddb63819bd047dc46a836149c8efa3d","observation_id":"265b171d-6f12-4c1a-a162-b347d4c7b5be","resolution":{"observed_at":"2026-08-05T10:24:24.074079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02193","last_updated":"2025-08-04T08:43:01Z","snapshot_observed_at":"2026-08-13T09:36:05.994763Z","submitted_at":"2025-08-04T08:43:01Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02193","snapshot_observed_at":"2026-08-05T10:24:24.077595Z","title":"Seed diffusion: A large-scale diffusion language model with high-speed inference, 2025.https://arxiv.org/abs/2508.02193","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.077595Z"},"links":{"cited_paper":"/paper/2508.02193","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:c3b0c14fe6e3accfa5bdbf4423e34f99e058499d9bf49903230c18e0818911e6","observation_id":"3e60f995-a943-4038-9c94-cff74bdf27ba","resolution":{"observed_at":"2026-08-05T10:24:24.077595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16990","last_updated":"2025-05-26T02:04:39Z","snapshot_observed_at":"2026-08-07T14:49:45.584405Z","submitted_at":"2025-05-22T17:55:04Z","title":"Dimple: Discrete Diffusion Multimodal Large Language Model with Parallel Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16990","snapshot_observed_at":"2026-08-05T10:24:24.088018Z","title":"Dimple: Discrete diffusion multimodal large language model with parallel decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.088018Z"},"links":{"cited_paper":"/paper/2505.16990","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:5502fbc4eed289f79f6e69588ad38cbc491d70ecdc66aec319060c5aafa1cdef","observation_id":"296ca13e-dcdd-426b-b190-15f310f1c5ad","resolution":{"observed_at":"2026-08-05T10:24:24.088018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.594424Z","title":"Code Block 7 presents the adjustments to the training loop required to learn a hybrid model","venue":null,"work_id":"46fac6e6-4d3f-4987-b0c6-1eb3dfebe51e","year":2024},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.091528Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:7808199adfe358d0e3a85c4e4df44de9e8733626ad9034fb0f0fa109305ebe7f","observation_id":"1e42e50b-0af7-4384-b721-5073e92e30fb","resolution":{"observed_at":"2026-08-05T10:24:24.597994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.582194Z","title":"Returns the runtime (in s) and flops of doing a `C=A@B` with A/B of shape `[m, k]/[k, n] `","venue":null,"work_id":"7a2ac4ba-2278-46f8-9428-0f0e89a18eb2","year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.094888Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:ae05fc714365b0a4980631182052994d740f4393513f97968f88976d8fb6498a","observation_id":"1db44844-1ee3-4524-b0a3-1da2825a7668","resolution":{"observed_at":"2026-08-05T10:24:24.587399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22618","last_updated":"2025-07-03T04:51:05Z","snapshot_observed_at":"2026-07-06T21:32:23.537939Z","submitted_at":"2025-05-28T17:39:15Z","title":"Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22618","snapshot_observed_at":"2026-08-05T10:24:24.084220Z","title":"Fast-dllm: Training-free acceleration of diffusion llm by enabling kv cache and parallel decoding.arXiv preprint arXiv:2505.22618, 2025a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.084220Z"},"links":{"cited_paper":"/paper/2505.22618","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:c9e6b2caef3087501498aa297b6212cf672e626716551c4586fe2b7b445b660a","observation_id":"ce45a66e-1f1e-4084-869d-0fe9bb39767a","resolution":{"observed_at":"2026-08-05T10:24:24.084220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:24:24.605185Z","title":"Samuel Webb Williams, Andrew Waterman, and David A Patterson","venue":null,"work_id":"784b320b-ab3a-4f8f-bbf8-967de0356d32","year":2008},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.081026Z"},"links":{"citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:8d01f992605f5abae046e970198f2100cbc9125d14c6098f0f7cc8ac8a729945","observation_id":"bc61fa90-1ac1-4d7d-b905-fee6c9023045","resolution":{"observed_at":"2026-08-05T10:24:24.608828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T10:24:24.015754Z","title":"Training verifiers to solve math word problems, 2021.https://arxiv.org/abs/2110.14168","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.015754Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:e40e6167318b3676261ce3726d9660468d240c64131cf05e276ab5da0da7aaa6","observation_id":"95b5b9c1-e1fb-446b-9ec5-1db96a75c63b","resolution":{"observed_at":"2026-08-05T10:24:24.015754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-16T23:36:44.216328Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-05T10:24:24.031548Z","title":"Better & faster large language models via multi-token prediction.arXiv preprint arXiv:2404.19737 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.031548Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:0862f2d765f1b1e791c81b438bf49b18fdc2aa97346205f526eb099236e66516","observation_id":"c27d2747-e039-47a7-9e1f-0a76a6fb6065","resolution":{"observed_at":"2026-08-05T10:24:24.031548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24857","last_updated":"2025-05-30T17:52:55Z","snapshot_observed_at":"2026-08-11T15:10:36.034898Z","submitted_at":"2025-05-30T17:52:55Z","title":"Accelerated Sampling from Masked Diffusion Models via Entropy Bounded Unmasking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24857","snapshot_observed_at":"2026-08-05T10:24:23.999472Z","title":"Accelerated sampling from masked diffusion models via entropy bounded unmasking.arXiv preprint arXiv:2505.24857 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:23.999472Z"},"links":{"cited_paper":"/paper/2505.24857","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:5cce93a755feedeba3144dc0110e0f9b2675331f41d4b058bbb12c7c2378e40a","observation_id":"ba1a3b7f-f5f2-45da-846a-5b844381f4b5","resolution":{"observed_at":"2026-08-05T10:24:23.999472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-14T20:35:19.337789Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05496","snapshot_observed_at":"2026-08-05T10:24:24.019470Z","title":"Gemini diffusion, 2025.https://deepmind.google/models/gemini-diffusion/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.019470Z"},"links":{"cited_paper":"/paper/2412.05496","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:711be2ca32239a9981cd8f93e2463648d8a7ce1e712c39bf9a8eb7e9538b2481","observation_id":"264f745c-63e3-4af6-b78a-ef8e0398a23b","resolution":{"observed_at":"2026-08-05T10:24:24.019470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05636","last_updated":"2025-02-10T20:51:18Z","snapshot_observed_at":"2026-08-17T17:39:52.288109Z","submitted_at":"2024-08-10T21:24:25Z","title":"Speculative Diffusion Decoding: Accelerating Language Generation through Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05636","snapshot_observed_at":"2026-08-05T10:24:24.012047Z","title":"Speculative diffusion decoding: Accelerating language generation through diffusion, 2025.https://arxiv.org/abs/ 2408.05636","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.012047Z"},"links":{"cited_paper":"/paper/2408.05636","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:e696e489a1b214e154f7e77e6282ffe84868eb9186341350061f967392a4ce28","observation_id":"f6e4096c-f191-4049-ac11-e4f53e748b24","resolution":{"observed_at":"2026-08-05T10:24:24.012047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T10:24:24.008167Z","title":"Accelerating large language model decoding with speculative sampling.arXiv preprint arXiv:2302.01318 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:24.008167Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:8f7ed5838cc1fea242164c4f930012b6ef928277070839a17540f27f28dd8d95","observation_id":"a33c4070-f5a2-465c-941f-a42d7c74115d","resolution":{"observed_at":"2026-08-05T10:24:24.008167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-14T13:55:40.999046Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-08-05T10:24:23.990590Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models.arXiv preprint arXiv:2503.09573,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T10:24:23.990590Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2509.04185"},"observation_digest":"sha256:22ff6758e11b370655b91f0a45c4efaa752db22f097429282315924b9335292c","observation_id":"f519578f-6d0c-42a4-9fad-e2c806f21169","resolution":{"observed_at":"2026-08-05T10:24:23.990590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04185","last_updated":"2025-09-04T13:02:39Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T00:39:58.408075Z","submitted_at":"2025-09-04T13:02:39Z","title":"Set Block Decoding is a Language Model Inference Accelerator"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 8 inbound Pith citation observations for arXiv:2509.04185."}