{"as_of":"2026-08-09T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10858eee472c32be60b7783bdad184e3a09069c690d8e818ab0dc7d2f9e6ff8f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:48:05.437417Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T03:30:22.329760Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":"2203.16487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lossless speedup of autoregressive translation with generalized aggressive decoding","venue":null,"work_id":"71daad25-1bfb-46ba-9f69-d35c09750357","year":2022},"citing_paper":{"arxiv_id":"2211.15089","last_updated":"2022-12-15T14:27:19Z","snapshot_observed_at":"2026-08-07T07:03:02.158312Z","submitted_at":"2022-11-28T06:08:54Z","title":"Continuous diffusion for categorical data","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-18T03:30:22.025578Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2211.15089"},"observation_digest":"sha256:4fb8b50d33c32e6ed2059acfd36882259539fe93840f096fcabf989d98faafb0","observation_id":"088c6fa3-60b6-42ac-9c4c-355e4b60d753","resolution":{"observed_at":"2026-05-18T03:30:22.333205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":"2203.16487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lossless speedup of autoregressive translation with generalized aggressive decoding","venue":null,"work_id":"71daad25-1bfb-46ba-9f69-d35c09750357","year":2022},"citing_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-14T22:34:15.638114Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2312.08935"},"observation_digest":"sha256:a3d393b465b70f8d3ff4a956290c54101f7e4cd1e1e02f5b1b9883ea50432af5","observation_id":"39b59b01-b700-46e7-8de0-1f46f446456f","resolution":{"observed_at":"2026-05-14T22:34:15.735737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-08-07T13:32:33.884257Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21487","last_updated":"2025-05-27T17:54:07Z","snapshot_observed_at":"2026-08-07T13:24:37.243429Z","submitted_at":"2025-05-27T17:54:07Z","title":"Hardware-Efficient Attention for Fast Decoding","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T13:32:33.884257Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2505.21487"},"observation_digest":"sha256:e793af1bf2c4ac42af8e462e23c12a84e583b1ff3dae2935c7cb699a393744cb","observation_id":"9110ff98-fbaa-4836-9a8b-59490b1c9cd7","resolution":{"observed_at":"2026-08-07T13:32:33.884257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-08-07T11:04:15.618806Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation.arXiv preprint arXiv:2203.16487, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03566","last_updated":"2025-06-04T04:30:30Z","snapshot_observed_at":"2026-08-08T23:21:08.715393Z","submitted_at":"2025-06-04T04:30:30Z","title":"POSS: Position Specialist Generates Better Draft for Speculative Decoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:15.618806Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2506.03566"},"observation_digest":"sha256:1058545c94ff84297561adef10c8e9b60a6755ab84f14d9ec73a09c538f1f146","observation_id":"25917fd6-8e89-484a-a0bc-1cf6216dd2ed","resolution":{"observed_at":"2026-08-07T11:04:15.618806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-08-06T17:06:34.603114Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11953","last_updated":"2025-07-16T06:39:11Z","snapshot_observed_at":"2026-08-09T05:28:13.139068Z","submitted_at":"2025-07-16T06:39:11Z","title":"IAM: Efficient Inference through Attention Mapping between Different-scale LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:06:34.603114Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2507.11953"},"observation_digest":"sha256:4b0fb0de22e13cb93337e938d615a911c2f409159f05ca2c6b7a8deb0c7e0d2f","observation_id":"024ec14d-13af-4286-88b8-edf2bc45f38d","resolution":{"observed_at":"2026-08-06T17:06:34.603114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-08-06T10:29:56.330746Z","title":"Speculative decoding: Exploiting speculative exe- cution for accelerating seq2seq generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23777","last_updated":"2025-08-06T09:51:03Z","snapshot_observed_at":"2026-08-07T07:56:49.904222Z","submitted_at":"2025-07-31T17:58:30Z","title":"XSpecMesh: Quality-Preserving Auto-Regressive Mesh Generation Acceleration via Multi-Head Speculative Decoding","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T10:29:56.330746Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2507.23777"},"observation_digest":"sha256:f0cf16ea0922687800106a28f6945684a30adc3766c5ba94c1e37b722c52d752","observation_id":"71a70f41-1941-4233-ae7e-3947746adaf3","resolution":{"observed_at":"2026-08-06T10:29:56.330746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":"2203.16487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lossless speedup of autoregressive translation with generalized aggressive decoding","venue":null,"work_id":"71daad25-1bfb-46ba-9f69-d35c09750357","year":2022},"citing_paper":{"arxiv_id":"2604.27747","last_updated":"2026-04-30T11:37:08Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:37:08Z","title":"Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-07T07:42:36.852261Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2604.27747"},"observation_digest":"sha256:4b35b78ea51ca8b55d388a04dab7bbfa522ae34c0515b18fce62e400b3d6098e","observation_id":"52d294ab-ba12-4e7c-9c26-463ec80f03b4","resolution":{"observed_at":"2026-05-12T10:06:29.908758Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":"2203.16487","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lossless speedup of autoregressive translation with generalized aggressive decoding","venue":null,"work_id":"71daad25-1bfb-46ba-9f69-d35c09750357","year":2022},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:36cd8fbc5b3dfc40afa4f9c0ed03f74d4675eca4b0b05e9beb430dcb899e4f2e","observation_id":"b40f0667-144e-4c19-9727-8617b1dbca42","resolution":{"observed_at":"2026-05-11T03:50:57.415594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16487","snapshot_observed_at":"2026-08-08T15:48:05.437417Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05303","last_updated":"2026-08-05T18:03:47Z","snapshot_observed_at":"2026-08-09T11:11:09.084826Z","submitted_at":"2026-08-05T18:03:47Z","title":"EdgeXpert: An Edge Device for Memory-Efficient LLM Inference with Mixture-of-Experts and Speculative Decoding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T15:48:05.437417Z"},"links":{"cited_paper":"/paper/2203.16487","citing_paper":"/paper/2608.05303"},"observation_digest":"sha256:104c9063e98e7dbe80c089544510d21fa46397c9d24dddd28caf963ac64f7160","observation_id":"1823bac8-8314-4eac-823e-f9ef4c1401c8","resolution":{"observed_at":"2026-08-08T15:48:05.437417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2203.16487/citation-record","integrity":"/paper/2203.16487/integrity","json":"/paper/2203.16487/citation-record.json","paper":"/paper/2203.16487"},"outbound":[],"paper":{"arxiv_id":"2203.16487","last_updated":"2023-10-30T01:36:06Z","latest_version":6,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:16:37.122006Z","submitted_at":"2022-03-30T17:27:09Z","title":"Speculative Decoding: Exploiting Speculative Execution for Accelerating Seq2seq Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2203.16487."}