{"as_of":"2026-08-14T10:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17036a8811c321e5191c58392168577b6f66ac888cd84722be1e0d5f1d68f80f","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:36:19.912415Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04974/citation-record","integrity":"/paper/2608.04974/integrity","json":"/paper/2608.04974/citation-record.json","paper":"/paper/2608.04974"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-06T12:36:18.022804Z","title":"LaMDA: Language models for dialog applications,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.022804Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:36a55ef6b783a947089a8b29069ff599c447b3539084cc17060151062b00a4e7","observation_id":"4abca992-c557-4037-94e4-b5ecdc3210d0","resolution":{"observed_at":"2026-08-06T12:36:18.022804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-06T12:36:18.075148Z","title":"Evaluating large language models trained on code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.075148Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:abfd75827936ebe6cdfed61a2153e6e1183da7dee1475e11a24dcd287ef93d0d","observation_id":"76ac4c14-d05a-4d7f-bb88-ce28039d7af2","resolution":{"observed_at":"2026-08-06T12:36:18.075148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.287084Z","title":"Language models are few-shot learners,","venue":null,"work_id":"453d88ea-09bc-4486-9c28-eee45a461b06","year":2020},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.164701Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:a2a7cfd3ce08bb1575909f9ee1eeb0e7c39a94f75e7ca7c9fc8ac9c3da5ce685","observation_id":"094b3ea1-7b1b-4432-a548-3d7ea802b001","resolution":{"observed_at":"2026-08-06T12:36:21.294524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.228799Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.228799Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:09306b3ba6902fc241fd6c975d5b3e3628051515739e9b313dd40172810787bf","observation_id":"d7f61f67-4ba0-498d-8a37-7b91d43461cf","resolution":{"observed_at":"2026-08-06T12:36:18.228799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.256634Z","title":"ReAct: Synergizing reasoning and acting in language models,","venue":null,"work_id":"f6d4cc7f-9a66-426e-9923-26a9efaab9ff","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.287856Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:9891daf64cf9db643d1489f2365d33f347802dc0d0191d5da8f236a0388f9902","observation_id":"b2868cd6-26e6-4e27-a8a1-c19c908c59c3","resolution":{"observed_at":"2026-08-06T12:36:21.261964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.238239Z","title":"Fast inference from transform- ers via speculative decoding,","venue":null,"work_id":"e722f020-3cce-4dea-b4a1-2740cc019a90","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.431450Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:e83430dc3a97e94754d203a22813d3a07aa175e49619181c1f855e6f8b2a1244","observation_id":"c5bd3f09-50e3-46a1-a499-9cdb7cbdb9c8","resolution":{"observed_at":"2026-08-06T12:36:21.243578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-13T23:55:57.074762Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T12:36:18.473974Z","title":"Accelerating large language model decoding with speculative sampling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.473974Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:28b43242b83fb3419a9093f9f7b88fa4b9018f9926560aca4909ff124c9a068c","observation_id":"0bed100a-8ffb-4e10-af62-61455f33b500","resolution":{"observed_at":"2026-08-06T12:36:18.473974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12000","last_updated":"2025-07-17T02:34:42Z","snapshot_observed_at":"2026-08-13T16:23:11.053861Z","submitted_at":"2025-07-16T07:55:06Z","title":"DSSD: Efficient Edge-Device LLM Deployment and Collaborative Inference via Distributed Split Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12000","snapshot_observed_at":"2026-08-06T12:36:18.592235Z","title":"DSSD: Efficient edge-device LLM deployment and collaborative inference via distributed split speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.592235Z"},"links":{"cited_paper":"/paper/2507.12000","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:ce20d76e1e83790ed8456f8a4f0054954e62c63f64417203416f04812094daf9","observation_id":"3882188b-0fda-4c61-a2bf-692a96cbc249","resolution":{"observed_at":"2026-08-06T12:36:18.592235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.613009Z","title":"SpecEdge: Scalable edge-assisted serving framework for interactive LLMs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.613009Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:32302c255d3a1498f59c853c6035ce2c0926d68769a60e2cf455a42c4966c114","observation_id":"e3dc7e1e-40e9-428c-adff-7f5eae568e78","resolution":{"observed_at":"2026-08-06T12:36:18.613009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13319","last_updated":"2026-05-25T08:06:41Z","snapshot_observed_at":"2026-08-12T19:43:54.105773Z","submitted_at":"2026-05-13T10:34:04Z","title":"PipeSD: An Efficient Cloud-Edge Collaborative Pipeline Inference Framework with Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13319","snapshot_observed_at":"2026-08-06T12:36:18.698765Z","title":"PipeSD: An efficient cloud-edge collaborative pipeline inference frame- work with speculative decoding,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.698765Z"},"links":{"cited_paper":"/paper/2605.13319","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:d08fc2d661f5e8431e073ecb905f9422d82d43759ca488f34de228e024e383ad","observation_id":"29417c33-f66f-4647-b731-c3b27e2231dd","resolution":{"observed_at":"2026-08-06T12:36:18.698765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.764588Z","title":"Communication-efficient collaborative LLM inference via distributed speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.764588Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:1ab820092242b535575c9f5abe1408452e6402376972aac2fbda8546250e3cee","observation_id":"70c9434f-3656-4483-9444-3e717a135414","resolution":{"observed_at":"2026-08-06T12:36:18.764588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:18.820864Z","title":"Fast collaborative inference via distributed speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.820864Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:84145b0aeb590936de47079cd8f85ffbf9d79acc6940fbc8be66abdb32b51018","observation_id":"e6f0231c-6d03-4eae-af2c-576218c9eb37","resolution":{"observed_at":"2026-08-06T12:36:18.820864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.25091","last_updated":"2026-06-23T18:55:18Z","snapshot_observed_at":"2026-08-06T04:30:21.060187Z","submitted_at":"2026-06-23T18:55:18Z","title":"Speculation at a Distance: Where Edge-Cloud Speculative Decoding Actually Pays Off","version":1},"cited_work":{"arxiv_id":"2606.25091","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.25091","snapshot_observed_at":"2026-08-06T12:36:20.689783Z","title":"Speculation at a Distance: Where Edge-Cloud Speculative Decoding Actually Pays Off","venue":"cs.DC","work_id":"c6b7469a-9909-4b5e-b3f6-0d54f0a244f2","year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.928319Z"},"links":{"cited_paper":"/paper/2606.25091","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:3215bc3b01d2e273aad7bd39775e440fd621b71e8a2ac3ed8709bfb79dbc8bf9","observation_id":"7d36d676-f2bc-4dd7-83b7-49ab960c675c","resolution":{"observed_at":"2026-08-06T12:36:20.698329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04255","last_updated":"2023-09-08T10:44:19Z","snapshot_observed_at":"2026-08-13T23:14:50.342875Z","submitted_at":"2023-09-08T10:44:19Z","title":"LLMCad: Fast and Scalable On-device Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04255","snapshot_observed_at":"2026-08-06T12:36:18.965771Z","title":"LLMCad: Fast and scalable on-device large language model inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:18.965771Z"},"links":{"cited_paper":"/paper/2309.04255","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:25941db614d0821a2b1bcd28010d1169ba1c0945fc94cf42940c40d709c5f263","observation_id":"7803a98a-0f7d-4895-b61c-0ebdf468abeb","resolution":{"observed_at":"2026-08-06T12:36:18.965771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.220542Z","title":"PipeInfer: Accelerating LLM inference using asynchronous pipelined speculation,","venue":null,"work_id":"b2c8c625-f310-48b4-bcc0-0c9c2aaf4ac6","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.041819Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:822a8f24d82ca8c75f6b0bceefcfed26cb9c50ea146caf3208d25b12296ce112","observation_id":"4756b5c1-76b0-41f7-9c6b-5df33728aad3","resolution":{"observed_at":"2026-08-06T12:36:21.225678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17375","last_updated":"2024-10-22T19:15:35Z","snapshot_observed_at":"2026-08-13T09:31:25.754334Z","submitted_at":"2024-10-22T19:15:35Z","title":"AMUSD: Asynchronous Multi-Device Speculative Decoding for LLM Acceleration","version":1},"cited_work":{"arxiv_id":"2410.17375","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17375","snapshot_observed_at":"2026-08-06T12:36:20.649879Z","title":"AMUSD: Asynchronous Multi-Device Speculative Decoding for LLM Acceleration","venue":"cs.CL","work_id":"7e6cbce8-9e34-4f93-a35d-a313b4cdb975","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.122331Z"},"links":{"cited_paper":"/paper/2410.17375","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:98f1b5793c32e3222725e72e1ba62aaf7ef16e1e044cb0922e7b9121d6c5b85c","observation_id":"5317e4c7-af90-4f9f-9723-cb26b2763491","resolution":{"observed_at":"2026-08-06T12:36:20.655192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11850","last_updated":"2025-02-17T03:33:50Z","snapshot_observed_at":"2026-08-12T23:04:27.100022Z","submitted_at":"2024-08-13T08:32:06Z","title":"PEARL: Parallel Speculative Decoding with Adaptive Draft Length","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11850","snapshot_observed_at":"2026-08-06T12:36:19.142900Z","title":"PEARL: Parallel speculative decoding with adaptive draft length,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.142900Z"},"links":{"cited_paper":"/paper/2408.11850","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:2bfc7840ca542d650c70720380e9470faf044eeaf8a4cdff510cbd9130889695","observation_id":"0f91947f-9f3b-4704-a4f2-5c78a3cfc602","resolution":{"observed_at":"2026-08-06T12:36:19.142900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.204877Z","title":"CoSine: Enhancing LLM serving via collaborative and decoupled speculative inference,","venue":null,"work_id":"f21beb7d-d7ed-469b-bb9d-d199d811ed33","year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.213196Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:d3874b71b810a5cc5f5292c514e07a02a6bbffc2eac92b8bb6a50f57a13f7e00","observation_id":"97ffcbad-81ac-4327-afd6-dfd0eaf6e471","resolution":{"observed_at":"2026-08-06T12:36:21.209820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11652","last_updated":"2026-04-07T01:02:52Z","snapshot_observed_at":"2026-08-11T14:14:01.400167Z","submitted_at":"2026-01-15T16:46:01Z","title":"WISP: Waste- and Interference-Suppressed Distributed Speculative LLM Serving at the Edge via Dynamic Drafting and SLO-Aware Batching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11652","snapshot_observed_at":"2026-08-06T12:36:19.307246Z","title":"WISP: Waste- and interference-suppressed distributed speculative LLM serving at the edge via dynamic drafting and SLO-aware batching,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.307246Z"},"links":{"cited_paper":"/paper/2601.11652","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:9fed71901925a9cfdf75fad7ee605bb4b19cff9440aba970538a5757372d67b1","observation_id":"2e4dcc7b-a326-494b-b78b-a271e1f1eb7d","resolution":{"observed_at":"2026-08-06T12:36:19.307246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.190485Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":"35f0616e-6f06-4ffe-8f81-49d075d6a04f","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.367716Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:c28d1d0217bcad079d7af62e74e48f7d8bf77401070b899ec95d9f86d6a3f89d","observation_id":"02334612-7cf9-4ad2-8318-e08e5c5458c2","resolution":{"observed_at":"2026-08-06T12:36:21.195343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.173212Z","title":"DistServe: Disaggregating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":"09ad9b73-71f1-475c-acaf-110f8f6ff9d2","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.486929Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:783d6095e8203b236d867b897a15415071fc0777bfc8ef16dda0876e1330399a","observation_id":"ec503571-a30b-443f-90ca-cea55c7dfc5b","resolution":{"observed_at":"2026-08-06T12:36:21.177676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.155491Z","title":"Hintjens,ZeroMQ: Messaging for Many Applications","venue":null,"work_id":"ac6a3923-58a6-4554-b139-2bbdf27ec9b3","year":2013},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.583413Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:e00bc5b3e11569b3f5d221d4ff43ec33a12d8a50818539ee5d592d2d5bfed786","observation_id":"d69efdaf-1f98-4cea-9110-35ed0e022303","resolution":{"observed_at":"2026-08-06T12:36:21.160747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T12:36:19.653286Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.653286Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:0dbb493090e1e7a0cf7cf8ef5528b3f93925fffaabde56438608b5b5109d9442","observation_id":"5283f376-d789-4feb-9e0d-1503c5616673","resolution":{"observed_at":"2026-08-06T12:36:19.653286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-06T12:36:19.780905Z","title":"ChatGLM: A family of large language models from GLM- 130B to GLM-4 All Tools,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.780905Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:e66c2f288755c9894d0c2d661e27e4943b2474a4f2560b28db1bb888429cd26e","observation_id":"cf1d515f-886d-4201-9050-fa36e1c54c1f","resolution":{"observed_at":"2026-08-06T12:36:19.780905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.137638Z","title":"GLM-4-0414 model series,","venue":null,"work_id":"185f52a3-bb56-4589-853d-2b0f5c4c19ee","year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.835335Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:ff58a0dad6697e3727a1f669a8dcc6b7b9c50311f5c1bb196afc06415091c1a7","observation_id":"ae5f4fff-3cf4-4b06-a654-810235f69f6a","resolution":{"observed_at":"2026-08-06T12:36:21.143920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T12:36:19.863122Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.863122Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:555c8c0512b83c8596f5e9db2171f1e98c2331424a670258dbae6513a97ee198","observation_id":"24e9ffe7-09bb-4376-b798-19fa828f2a4a","resolution":{"observed_at":"2026-08-06T12:36:19.863122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T12:36:19.867867Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.867867Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:b24d1316dc6ab390ec4ebfb5a3a3cd324869364271c9e7ca60ab1a165ade1fee","observation_id":"024c70b3-fe2b-4f9c-b370-93dd627a7ef3","resolution":{"observed_at":"2026-08-06T12:36:19.867867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.120820Z","title":"Network emulation with NetEm,","venue":null,"work_id":"93051d7a-0026-46f1-8470-be642ba0b8ed","year":2005},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.873469Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:962768eaeef0bf412ebd598b0b2eabf218628a8647a6be5359824cd296d41bc9","observation_id":"23ba4cc5-d4bb-4acd-853a-fdcae6da06db","resolution":{"observed_at":"2026-08-06T12:36:21.125916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7514.34058","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:20.506507Z","title":"Understanding operational 5G: A first measurement study on its coverage, performance and energy consumption,","venue":null,"work_id":"5ac81640-d85b-453d-843e-99f613592021","year":2020},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.877613Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:8d4a277080df5888472cbf6a30491ffb9c08d0e0bea679bc04c1cc383b6c24dd","observation_id":"79db0f21-fc59-4108-a3c3-a494a5fc772f","resolution":{"observed_at":"2026-08-06T12:36:20.517187Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.103214Z","title":"AccuMO: Accuracy- centric multitask offloading in edge-assisted mobile augmented reality,","venue":null,"work_id":"a1bfd080-e69f-4c72-b989-34d1d961bf9d","year":2023},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.881894Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:ac3aa2ccc0518bd6a4c602b8482363810d76a04648694ec48b7cdaf11190f864","observation_id":"0eaae0b7-6455-49db-ab51-ad99b27070dc","resolution":{"observed_at":"2026-08-06T12:36:21.108775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.886247Z","title":"A variegated look at 5G in the wild: Performance, power, and QoE implications,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.886247Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:51f3d98c3cc3f7afdeead7371df7edac8ca703d7a0f9b3ea98eeda97028672bd","observation_id":"56922e96-a8a1-42f6-8f67-5b41aa1e31c4","resolution":{"observed_at":"2026-08-06T12:36:19.886247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.081706Z","title":"SpecInfer: Accelerating large language model serving with tree-based speculative inference and verification,","venue":null,"work_id":"e49db424-d1c5-4875-9b51-8b5291663a86","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.890404Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:766b98bf8bbad56ce426d44e6eaf24030cd9a63f2159a78d936e2239e4921ed1","observation_id":"43331e2d-b63c-4062-8ec1-3e4dadd27321","resolution":{"observed_at":"2026-08-06T12:36:21.087597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.055719Z","title":"Medusa: Simple LLM inference acceleration framework with multiple decoding heads,","venue":null,"work_id":"ec012342-3eef-4ec9-b28a-494d3144846e","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.894655Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:7048fadd7f774101fe7bca0b35219d6ca883d9429f3b04c7db9df6cfceda4e30","observation_id":"ed46086d-f049-4d37-bdd6-73f221525c1c","resolution":{"observed_at":"2026-08-06T12:36:21.064875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-13T04:15:09.481659Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T12:36:19.898830Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.898830Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:f2c81f8ea2bc28a50625205eb6c89f872b4ca2ac51416682adce49be6ead62ac","observation_id":"efa1ef77-0fb2-48ac-89d2-8614997cad04","resolution":{"observed_at":"2026-08-06T12:36:19.898830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.903391Z","title":"Conformal sparsification for bandwidth-efficient edge-cloud speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.903391Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:117df6da13b5ffcbec24027abfca933eac850a416ff39a4c16911177a17edf02","observation_id":"7c7deeb8-c10c-492d-a554-e08f6192cd1e","resolution":{"observed_at":"2026-08-06T12:36:19.903391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:19.907751Z","title":"Quantize- sample-and-verify: LLM acceleration via adaptive edge-cloud speculative decoding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.907751Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:2703dadde6f8e7b627c58feaee50cc63eb3fe34bed88ba810d3b538608cb53c3","observation_id":"a6e9a913-8c70-49fa-bc55-83f5984496bf","resolution":{"observed_at":"2026-08-06T12:36:19.907751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:36:21.039472Z","title":"Taming throughput-latency tradeoff in LLM inference with Sarathi-Serve,","venue":null,"work_id":"80536e16-1418-4b97-8671-f6857f21c8d1","year":2024},"citing_paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:36:19.912415Z"},"links":{"citing_paper":"/paper/2608.04974"},"observation_digest":"sha256:61ce02b709a1e1ac7394314647b04138a0a66f566c9ef51d1d11ff7e9bfe28d4","observation_id":"4253d224-9c9d-4097-b566-1200d8643893","resolution":{"observed_at":"2026-08-06T12:36:21.044466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04974","last_updated":"2026-08-05T15:45:15Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-13T02:43:05.673898Z","submitted_at":"2026-08-05T15:45:15Z","title":"AsymSpec: Efficient Cloud-Edge Speculative Decoding over Asymmetric Networks"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2608.04974."}