{"as_of":"2026-08-15T21:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:563019da18382994b9b5f53949d88bc9d462881e73f9fe471ccbf5e481fc3f6c","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:56.200787Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18181/citation-record","integrity":"/paper/2507.18181/integrity","json":"/paper/2507.18181/citation-record.json","paper":"/paper/2507.18181"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T14:42:55.990819Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:55.990819Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3ba2b6a57dfcd06a51ffa6c148dab3bac1c91a08e97f85279dd0cb88bd67f0ad","observation_id":"de92f81f-faf7-44ac-90ec-95207624deb4","resolution":{"observed_at":"2026-08-06T14:42:55.990819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T14:42:55.998668Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:55.998668Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c0bb50b41a386cca50ed4676dd33d62045c30850571799eb605e70ae3abcc65d","observation_id":"2e04d542-8800-423e-bdfc-69de61ad0d76","resolution":{"observed_at":"2026-08-06T14:42:55.998668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.903659Z","title":"Toolqa: A dataset for llm question answering with external tools,","venue":null,"work_id":"cb52c931-2395-454c-8bd5-501637c99b7e","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.004793Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c531e64a16e7df607d96bf90d4322d58be52ccbc8763efd27f882eb8f8c73f1a","observation_id":"01e6fea3-b51b-4b12-930c-720a8b173426","resolution":{"observed_at":"2026-08-06T14:42:56.909740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-06T14:42:56.011964Z","title":"Rt-2: Vision-language- action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.011964Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:7df58b906d5737392d25a79b053f7e35232e6b4cf11b69774630ddfcd25a4133","observation_id":"1c4b2c8a-fd7c-4f30-8c15-462075c4fce3","resolution":{"observed_at":"2026-08-06T14:42:56.011964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.880758Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"7becb6c9-a4e1-414e-950a-83b149f0f0e0","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.020418Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:4848cce2caa7904550dd85c265f5ae0610774a1080b8433cb7fed2ad0e685a9f","observation_id":"bc724691-917e-4c1d-8afa-cf06cafa5ba3","resolution":{"observed_at":"2026-08-06T14:42:56.886571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09569","last_updated":"2024-06-13T20:20:29Z","snapshot_observed_at":"2026-08-12T23:43:12.064409Z","submitted_at":"2024-06-13T20:20:29Z","title":"Speech ReaLLM -- Real-time Streaming Speech Recognition with Multimodal LLMs by Teaching the Flow of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09569","snapshot_observed_at":"2026-08-06T14:42:56.029693Z","title":"Speech reallm– real-time streaming speech recognition with multimodal llms by teaching the flow of time,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.029693Z"},"links":{"cited_paper":"/paper/2406.09569","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:1a680256714f0b11093c312ff567ebf68fc821af7199afedd26a1a21f03580d4","observation_id":"21734548-2019-4bc3-8084-296e92507613","resolution":{"observed_at":"2026-08-06T14:42:56.029693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-08-13T15:17:10.560696Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-06T14:42:56.037314Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.037314Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:55eb7edcd4df6fbcdfbaa091216338a1e80a9bec03c89fdb72b68ca82e44a581","observation_id":"b80dc020-9196-44e7-8b93-c1503b356253","resolution":{"observed_at":"2026-08-06T14:42:56.037314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-08-15T18:25:40.547533Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-06T14:42:56.043822Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.043822Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:f36a178c0d70fa6b2384241d190d2dfa7158f7ca2b0c35d07935e302e632377a","observation_id":"65f20b7f-5213-4063-be88-bbe4978d02b0","resolution":{"observed_at":"2026-08-06T14:42:56.043822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.050084Z","title":"Prompting large language models with speech recognition abilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.050084Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:bcb544e6f7b04b7724fb0138e12fae6bd13e1e7568bb44e7a286ce639a1a72cb","observation_id":"e729f6ac-1491-41e4-a5c7-18a9eca2124d","resolution":{"observed_at":"2026-08-06T14:42:56.050084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19954","last_updated":"2024-06-28T14:40:03Z","snapshot_observed_at":"2026-08-12T23:32:53.413921Z","submitted_at":"2024-06-28T14:40:03Z","title":"BESTOW: Efficient and Streamable Speech Language Model with the Best of Two Worlds in GPT and T5","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19954","snapshot_observed_at":"2026-08-06T14:42:56.055144Z","title":"Bestow: Efficient and streamable speech language model with the best of two worlds in gpt and t5,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.055144Z"},"links":{"cited_paper":"/paper/2406.19954","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:6ecb2980b090c90dc8cba166952902f6b554e117fea9b04c36ecbec075d3801f","observation_id":"daa9695a-152c-4faf-8abb-2599c78ae90b","resolution":{"observed_at":"2026-08-06T14:42:56.055144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T14:42:56.060549Z","title":"Accelerating large language model decoding with speculative sam- pling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.060549Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:46832f9ee454ead4a507ac5dd933e616907c9f3d386d9683eddba2b251810f7c","observation_id":"fbf8372b-7af9-4290-8c7a-f53c317d8c70","resolution":{"observed_at":"2026-08-06T14:42:56.060549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.850282Z","title":"Fast inference from transform- ers via speculative decoding,","venue":null,"work_id":"d384e35a-8468-483b-8a9e-45865cf1603a","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.066142Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:62210dfd8d962e3c77966660fded1fb775a6362ca19e412443f64628cb7b04e7","observation_id":"fdc72fae-8afb-4ddc-85bb-e7e56106503a","resolution":{"observed_at":"2026-08-06T14:42:56.854937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-08-13T11:40:43.963312Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-06T14:42:56.072232Z","title":"Specinfer: Accelerating generative large language model serving with tree-based speculative inference and verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.072232Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:d75cd38860ec75b4365a2798eb80ccebedae308a126b19012dfb147ef7c99718","observation_id":"24d2f468-67f1-4805-841e-a7bdb2402af4","resolution":{"observed_at":"2026-08-06T14:42:56.072232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-06T14:42:56.078104Z","title":"Medusa: Simple llm inference acceleration framework with multiple decoding heads,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.078104Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:b3da47a2ffebd545eca622ff70a83670821031362d20f4bbbaccb84ce165f1e3","observation_id":"08d9a2c0-da64-4c02-ad38-d3f62d74b9d7","resolution":{"observed_at":"2026-08-06T14:42:56.078104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-06T14:42:56.083727Z","title":"Eagle: Speculative sampling re- quires rethinking feature uncertainty,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.083727Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c483a023e1825ae2a607a147f2a94053a059884f0075367fcf7e8def009658f5","observation_id":"88326143-65d3-4c93-a2f4-f6479bdf695e","resolution":{"observed_at":"2026-08-06T14:42:56.083727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11744","last_updated":"2024-10-15T16:21:15Z","snapshot_observed_at":"2026-08-12T22:22:35.134401Z","submitted_at":"2024-10-15T16:21:15Z","title":"DySpec: Faster Speculative Decoding with Dynamic Token Tree Structure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11744","snapshot_observed_at":"2026-08-06T14:42:56.088831Z","title":"Dyspec: Faster speculative decoding with dynamic token tree structure,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.088831Z"},"links":{"cited_paper":"/paper/2410.11744","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:b03322e6c2340e39ebb3d1afff72a805d22bcd0790b9cd654f6a313eeec0d063","observation_id":"b1f4f612-a7f2-423b-97f4-69f78366719e","resolution":{"observed_at":"2026-08-06T14:42:56.088831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15869","last_updated":"2024-09-24T08:42:31Z","snapshot_observed_at":"2026-08-12T22:38:52.404778Z","submitted_at":"2024-09-24T08:42:31Z","title":"Whisper in Medusa's Ear: Multi-head Efficient Decoding for Transformer-based ASR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15869","snapshot_observed_at":"2026-08-06T14:42:56.099285Z","title":"Whisper in medusa’s ear: Multi-head efficient decoding for transformer- based asr,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.099285Z"},"links":{"cited_paper":"/paper/2409.15869","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:bf10879bdfc3a6e15824e956ee4fef423414b577524882baac609bc69310df39","observation_id":"b228948d-24cb-4c9a-b9f9-dfd6464a26e7","resolution":{"observed_at":"2026-08-06T14:42:56.099285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00430","last_updated":"2023-11-01T10:45:07Z","snapshot_observed_at":"2026-08-13T05:35:04.248097Z","submitted_at":"2023-11-01T10:45:07Z","title":"Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00430","snapshot_observed_at":"2026-08-06T14:42:56.105526Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.105526Z"},"links":{"cited_paper":"/paper/2311.00430","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:6d0babbec89e4e0040bc9a6070b1e3a8a16bdfc894feb6abf78a5e558b3f6c23","observation_id":"4a12db20-3fba-404d-9755-e144de931249","resolution":{"observed_at":"2026-08-06T14:42:56.105526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-15T19:06:16.181826Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T14:42:56.113650Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.113650Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:f0bfc3d7ee23b5a87bb1485f34f6da8612f6c35698e26715595fcc892d39fed4","observation_id":"581e39d2-a2e8-4a33-9fa6-4007ec3be640","resolution":{"observed_at":"2026-08-06T14:42:56.113650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.119922Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.119922Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:4d46136bb9870aaa59a0cd7f92cf66f2b999ba4d982a549fbd8627a6f8ee5e86","observation_id":"a270a48d-e080-4856-923d-6cb749901da6","resolution":{"observed_at":"2026-08-06T14:42:56.119922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T14:42:56.125624Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.125624Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:20396f4002a9c0d80d7691868b312f5cadf4f0ea2e006119cd2a7b64a2772fc6","observation_id":"48df1ca7-cf0c-4c7f-a01b-8286b5a3a499","resolution":{"observed_at":"2026-08-06T14:42:56.125624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T14:42:56.131841Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.131841Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:206be8544e37b69f9c7c7c13324e4405adc945e9f3a18f07d616650ee370b5e7","observation_id":"05d14811-e291-4952-8b7b-2341e71d1cb7","resolution":{"observed_at":"2026-08-06T14:42:56.131841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13485","last_updated":"2024-02-21T02:51:07Z","snapshot_observed_at":"2026-08-15T13:58:01.847837Z","submitted_at":"2024-02-21T02:51:07Z","title":"ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding","version":1},"cited_work":{"arxiv_id":"2402.13485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13485","snapshot_observed_at":"2026-08-06T14:42:56.429631Z","title":"ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding","venue":"cs.LG","work_id":"79221109-7b8d-4654-bd6e-685eefc460ae","year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.137565Z"},"links":{"cited_paper":"/paper/2402.13485","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:30a3f2cca1f3ac37da3d573902f6e153d5ed9871ee041b2d8689fe367600f2d9","observation_id":"a3fbdefc-9124-4558-89b6-5747d771b5c1","resolution":{"observed_at":"2026-08-06T14:42:56.437339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16858","last_updated":"2024-06-30T15:03:25Z","snapshot_observed_at":"2026-08-13T18:09:06.904816Z","submitted_at":"2024-06-24T17:59:11Z","title":"EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16858","snapshot_observed_at":"2026-08-06T14:42:56.143024Z","title":"Eagle-2: Faster infer- ence of language models with dynamic draft trees,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.143024Z"},"links":{"cited_paper":"/paper/2406.16858","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:44923de218adaea86c1c908fcd33ec167249235cdb5c36a6721f6c092bc5553c","observation_id":"f31eb41e-0fe5-4dab-ae74-66c0b9170f8a","resolution":{"observed_at":"2026-08-06T14:42:56.143024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-13T04:15:09.481659Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T14:42:56.148559Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.148559Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:a04d0c9c717b6f88f7083f81ef9cb0ca82c15ed19a4a606a1be1c89463c13321","observation_id":"2b5560ce-9c21-4436-92ab-f9fec4d89794","resolution":{"observed_at":"2026-08-06T14:42:56.148559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06706","last_updated":"2024-01-12T17:15:23Z","snapshot_observed_at":"2026-08-13T04:43:48.759883Z","submitted_at":"2024-01-12T17:15:23Z","title":"Multi-Candidate Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06706","snapshot_observed_at":"2026-08-06T14:42:56.153661Z","title":"Multi-candidate speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.153661Z"},"links":{"cited_paper":"/paper/2401.06706","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:9c5b50aaf443337709cfc8176c633722a2ef5cc8886306d9e20651277b225aac","observation_id":"edb5eac1-7dd3-4861-8030-aa164879a2ae","resolution":{"observed_at":"2026-08-06T14:42:56.153661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.158384Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.158384Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:61d5afcecc85a309ff09ffa2cccef8767672e52bae25ca8b7fad4b273d52c4c8","observation_id":"383dba0e-d0a1-48d7-87a9-4c55d2562b42","resolution":{"observed_at":"2026-08-06T14:42:56.158384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00496","last_updated":"2018-10-28T14:29:46Z","snapshot_observed_at":"2026-08-14T18:33:50.882150Z","submitted_at":"2018-09-03T08:38:34Z","title":"LRS3-TED: a large-scale dataset for visual speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00496","snapshot_observed_at":"2026-08-06T14:42:56.162477Z","title":"Lrs3-ted: a large-scale dataset for visual speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.162477Z"},"links":{"cited_paper":"/paper/1809.00496","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:40567cfe55c9c1078fca59af041dc12a69162dc8351e3abbff6d5507d3ead304","observation_id":"cd4ce433-0015-48b5-b528-4c77f79762c4","resolution":{"observed_at":"2026-08-06T14:42:56.162477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05589","last_updated":"2024-10-08T01:05:08Z","snapshot_observed_at":"2026-08-12T22:28:39.366007Z","submitted_at":"2024-10-08T01:05:08Z","title":"ParallelSpec: Parallel Drafter for Efficient Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05589","snapshot_observed_at":"2026-08-06T14:42:56.168146Z","title":"Parallel- spec: Parallel drafter for efficient speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.168146Z"},"links":{"cited_paper":"/paper/2410.05589","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:ce4c060d99b121c860f31e36a2f9a5e33df357ba2115fd487d8350ab51933921","observation_id":"d4c2cbb7-5402-430d-9009-72f954f1f126","resolution":{"observed_at":"2026-08-06T14:42:56.168146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07177","last_updated":"2024-06-10T01:36:31Z","snapshot_observed_at":"2026-08-13T10:57:16.489873Z","submitted_at":"2023-10-11T04:03:42Z","title":"Online Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07177","snapshot_observed_at":"2026-08-06T14:42:56.172945Z","title":"Online speculative decoding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.172945Z"},"links":{"cited_paper":"/paper/2310.07177","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:29555819743a2dc328a82ac0dd7ad4995aa67d31da2650b7e328cdaa342bf956","observation_id":"db89456a-46ca-419a-a6a3-98af10f03b63","resolution":{"observed_at":"2026-08-06T14:42:56.172945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.178146Z","title":"Spectr: Fast speculative decoding via optimal transport,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.178146Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:e1ed89b08ba2ffc6428ec9a03cbc338f7a16d843feb8db1069c870425196fd18","observation_id":"f6c432d6-0893-4a3b-98f2-74ff3dd8867c","resolution":{"observed_at":"2026-08-06T14:42:56.178146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14160","last_updated":"2024-03-05T06:55:26Z","snapshot_observed_at":"2026-08-14T03:07:18.134184Z","submitted_at":"2024-02-21T22:57:49Z","title":"Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14160","snapshot_observed_at":"2026-08-06T14:42:56.183295Z","title":"Recursive speculative decoding: Accelerating llm inference via sampling without replacement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.183295Z"},"links":{"cited_paper":"/paper/2402.14160","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3ff99dba821772875637408b5ee5117559027e14145c64c0dbf17e8d561f200c","observation_id":"4a754c70-49bc-4b8d-a26a-8e6d231d0cbf","resolution":{"observed_at":"2026-08-06T14:42:56.183295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09919","last_updated":"2024-12-13T19:50:19Z","snapshot_observed_at":"2026-08-13T00:53:52.253168Z","submitted_at":"2024-03-14T23:40:56Z","title":"Recurrent Drafter for Fast Speculative Decoding in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09919","snapshot_observed_at":"2026-08-06T14:42:56.188422Z","title":"Recurrent drafter for fast speculative decoding in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.188422Z"},"links":{"cited_paper":"/paper/2403.09919","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:53853c13c9389afbba63860d559442d41ff7017fb9de905eb9379cdb960d8d7e","observation_id":"9faaa76d-0b1c-4be5-b78f-4da91433aea4","resolution":{"observed_at":"2026-08-06T14:42:56.188422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.796336Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality, march 2023,","venue":null,"work_id":"08b27198-9d17-4a4a-a294-127808daa021","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.195443Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3fd938b26904c4337828c56847367655e344548aec75146d542eb68a7c087ee1","observation_id":"9cb39e25-dfa2-4929-866e-acc0dc1c65e7","resolution":{"observed_at":"2026-08-06T14:42:56.801696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-13T04:19:27.486516Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-06T14:42:56.200787Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.200787Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:cd89de8b7d993f85d32c6ff56ce1b15debe0d9e0a89e35eb1ef72187744d5dcf","observation_id":"6ac5c690-1150-4e61-b0fd-60d81021b3ca","resolution":{"observed_at":"2026-08-06T14:42:56.200787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T09:21:04.969128Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.18181."}