{"as_of":"2026-08-10T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:380bdfd598cf09623c010e695c079dde16ff3fc94c509bf7da42c08f98eade3e","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:12:29.003107Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:08:29.233848Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:40:41.670402Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"cited_work":{"arxiv_id":"2502.06282","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06282","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jakiro: Boosting speculative decoding with decoupled multi-head via moe","venue":null,"work_id":"24145648-a677-47d3-991d-a7ede758715a","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":285,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2502.06282","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:65655c0c60cdfdbd37ec3bafc31408d962fcc8543038b9cf51c1cec9b7a25ba8","observation_id":"29553447-b171-4959-9441-10f2afb7c03a","resolution":{"observed_at":"2026-05-12T08:40:41.672843Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06282","snapshot_observed_at":"2026-07-31T15:02:37.528129Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24434","last_updated":"2026-07-27T13:44:42Z","snapshot_observed_at":"2026-08-04T22:26:57.428934Z","submitted_at":"2026-07-27T13:44:42Z","title":"DraftExpert: Expansion-Aware Self-Speculative Decoding for End-Device MoE Inference","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T15:02:37.528129Z"},"links":{"cited_paper":"/paper/2502.06282","citing_paper":"/paper/2607.24434"},"observation_digest":"sha256:8608a744b420eeaf925468cc85fcf9e0b48e97955c0d254a4bf17c5320b865a9","observation_id":"68fa8e58-4876-40ce-9b54-5dfa87a0838b","resolution":{"observed_at":"2026-07-31T15:02:37.528129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06282","snapshot_observed_at":"2026-08-07T21:08:29.233848Z","title":"Jakiro: Boosting speculative decoding with decoupled multi-head via MoE,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05926","last_updated":"2026-08-06T11:57:36Z","snapshot_observed_at":"2026-08-09T23:12:32.886805Z","submitted_at":"2026-08-06T11:57:36Z","title":"BALANCE: Hybrid Autoregressive-Speculative LLM Inference in Wireless Edge Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T21:08:29.233848Z"},"links":{"cited_paper":"/paper/2502.06282","citing_paper":"/paper/2608.05926"},"observation_digest":"sha256:024b4fdec1c51ae31932514e971751d170553b9431dc11583d0c954bb4f1d119","observation_id":"65d5aa5c-6c44-4655-8b74-163e69737c36","resolution":{"observed_at":"2026-08-07T21:08:29.233848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06282/citation-record","integrity":"/paper/2502.06282/integrity","json":"/paper/2502.06282/citation-record.json","paper":"/paper/2502.06282"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-08T16:12:28.600149Z","title":"Hydra: Sequentially- dependent draft heads for medusa decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.600149Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:945e5f2e4397f03bd786865bb5a28c71abb3a9ad196d13137946bf6c5c2614ee","observation_id":"f884bab6-ac51-4e5e-b762-2bf828d90301","resolution":{"observed_at":"2026-08-08T16:12:28.600149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-08T16:12:28.719796Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.719796Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:cab5eb353a1ad04ed46701aa559151738c0f4245fd67b71ac3820756c2d263ea","observation_id":"8e729bbe-b16a-4451-b2e9-224ae6d3c0c7","resolution":{"observed_at":"2026-08-08T16:12:28.719796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03883","last_updated":"2024-03-11T02:01:09Z","snapshot_observed_at":"2026-08-06T11:43:44.726916Z","submitted_at":"2023-09-07T17:45:31Z","title":"DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03883","snapshot_observed_at":"2026-08-08T16:12:28.731398Z","title":"Chuang, Y .-S., Xie, Y ., Luo, H., Kim, Y ., Glass, J., and He, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.731398Z"},"links":{"cited_paper":"/paper/2309.03883","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:822ebd942cba66b1714e644388d30ab5ab16bf36ac4b0f67c9f72548d3fcbe0e","observation_id":"3e338f42-b959-4484-9153-5ae547bfbe16","resolution":{"observed_at":"2026-08-08T16:12:28.731398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T16:12:28.736999Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.736999Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:64dce05fa44dbe978a4c0280342e3f657e3a309b4d9483d9b2b4495d31033d57","observation_id":"6bce880c-a622-479c-9517-99ccbb98a1ad","resolution":{"observed_at":"2026-08-08T16:12:28.736999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:12:28.747736Z","title":"URL https://doi.org/ 10.18653/v1/2022.acl-long.489","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.747736Z"},"links":{"citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:3422bf83faaa9e0fc6b0e1e0ba143827aa43fc37020a26d51d44a07ddf98952b","observation_id":"e132727a-6662-497e-bfb9-f076ae469a48","resolution":{"observed_at":"2026-08-08T16:12:28.747736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T16:12:28.767844Z","title":"press/v162/du22c.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.767844Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:96c2c22099ec8720b4c7fcf4779bcebfab216c35a727d1483b1efffa0a83992a","observation_id":"39a44266-bcfe-4f2c-9020-62900aded5a1","resolution":{"observed_at":"2026-08-08T16:12:28.767844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-08-08T16:12:28.803450Z","title":"Ghazvininejad, M., Levy, O., Liu, Y ., and Zettlemoyer, L","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.803450Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:b0a1ef8ce60a243631d3bc2908add898da484cbbc681ffda9e472ba74e360876","observation_id":"b21138b6-a5d9-4917-8968-b42ce5c6347e","resolution":{"observed_at":"2026-08-08T16:12:28.803450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-08T16:12:28.851712Z","title":"Deepseek-r1: In- centivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.851712Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:5f76bbcc2e82dda448a48165a0f2ef6504f6b9b81b76c79498a9643d7d9a54b7","observation_id":"4b6f7776-1fa1-4f32-a2f2-823cce307eb1","resolution":{"observed_at":"2026-08-08T16:12:28.851712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-08T16:12:28.862322Z","title":"Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.862322Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:d007054495b36f8323c05d9b398fb0f819e9136e7403ca583bc12824f44ad58d","observation_id":"af491f6d-2acc-400c-969b-9c9ff6549d97","resolution":{"observed_at":"2026-08-08T16:12:28.862322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:12:28.872124Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.872124Z"},"links":{"citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:d2fb27bd800a778933f27393b527d86a837cdc15a4701e65d77336c387d33040","observation_id":"474ecf65-4c8e-4552-9d5c-53b895f8eedf","resolution":{"observed_at":"2026-08-08T16:12:28.872124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15097","last_updated":"2023-07-10T06:08:55Z","snapshot_observed_at":"2026-08-10T04:03:16.029105Z","submitted_at":"2022-10-27T00:58:21Z","title":"Contrastive Decoding: Open-ended Text Generation as Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15097","snapshot_observed_at":"2026-08-08T16:12:28.877138Z","title":"L., Holtzman, A., Fried, D., Liang, P., Eisner, J., Hashimoto, T., Zettlemoyer, L., and Lewis, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.877138Z"},"links":{"cited_paper":"/paper/2210.15097","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:be0aa971f01cf6677140a7197204b5321e984c615943cd2597993829d389de4f","observation_id":"da351026-4d11-4b83-a666-09db98255bc9","resolution":{"observed_at":"2026-08-08T16:12:28.877138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-08T16:12:28.882739Z","title":"Eagle: Speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.882739Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:c87de681b9909aeb23a8b0477122e4d7202c82b6ddac34f403fce486abe24436","observation_id":"da4b6d6f-363f-48f0-8e87-2471d32ebda5","resolution":{"observed_at":"2026-08-08T16:12:28.882739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-07-06T15:28:24.682211Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-08T16:12:28.888564Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.888564Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:0bfc7298cf4d2dead1aaf06e17bff750402d8f700a07c85769f5ecd62dfad602","observation_id":"b17e9eeb-c3b0-4415-9ecd-2f57792989f9","resolution":{"observed_at":"2026-08-08T16:12:28.888564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13581","last_updated":"2023-11-22T18:37:27Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T18:37:27Z","title":"PaSS: Parallel Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13581","snapshot_observed_at":"2026-08-08T16:12:28.893367Z","title":"Pass: Parallel specula- tive sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.893367Z"},"links":{"cited_paper":"/paper/2311.13581","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:978bd9ad416b82d44a80be14d803d95151c3ff1f42a548d4b4bab8cecc0f68d5","observation_id":"4d9080f2-e0a0-4cff-903e-92c91b7322af","resolution":{"observed_at":"2026-08-08T16:12:28.893367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.06023","last_updated":"2016-08-26T16:13:13Z","snapshot_observed_at":"2026-07-30T19:30:50.474373Z","submitted_at":"2016-02-19T02:04:18Z","title":"Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.06023","snapshot_observed_at":"2026-08-08T16:12:28.914574Z","title":"Ab- stractive text summarization using sequence-to-sequence rnns and beyond","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.914574Z"},"links":{"cited_paper":"/paper/1602.06023","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:b4b78e85554ca48dd85935258358916cc7059f13b4ab7a9531535fec95b95fbc","observation_id":"d4edc6f5-7857-4b8a-8bb7-3bd0c4337de6","resolution":{"observed_at":"2026-08-08T16:12:28.914574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-08T16:12:28.967060Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.967060Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:3564ab738c6eae0e2b76bdad4bcc9c3647e1684b7f834932ff38740573a7aed9","observation_id":"2fcb2dfe-9410-4471-b1d6-9ea6841abe07","resolution":{"observed_at":"2026-08-08T16:12:28.967060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01313","last_updated":"2024-01-08T16:19:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T17:56:30Z","title":"A Comprehensive Survey of Hallucination Mitigation Techniques in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01313","snapshot_observed_at":"2026-08-08T16:12:28.983368Z","title":"A comprehensive survey of hal- lucination mitigation techniques in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.983368Z"},"links":{"cited_paper":"/paper/2401.01313","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:678d3d37beb2d614d5253f0206ed0d85e552c1d508c3f47c396e33f39a9ded99","observation_id":"61f01c38-99fe-4aff-bc26-7a9c44931861","resolution":{"observed_at":"2026-08-08T16:12:28.983368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T16:12:28.988275Z","title":"Llama: Open and efficient foundation lan- guage models (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.988275Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:dba050eedda2baaf272ea78dee77377df6178afb292e94f17f0ebe56c3c959fd","observation_id":"7dd7cfd9-a3be-4322-b895-9ca44f433103","resolution":{"observed_at":"2026-08-08T16:12:28.988275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07851","last_updated":"2024-06-04T17:08:37Z","snapshot_observed_at":"2026-07-06T17:15:46.395218Z","submitted_at":"2024-01-15T17:26:50Z","title":"Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07851","snapshot_observed_at":"2026-08-08T16:12:28.993285Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.993285Z"},"links":{"cited_paper":"/paper/2401.07851","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:13bae900e499b816a0fef090530a778154c150f5ee8225e848f3cb3b0b35f83e","observation_id":"8f738c5d-bf30-4c14-9d3d-1108f790f33a","resolution":{"observed_at":"2026-08-08T16:12:28.993285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:12:29.467711Z","title":"Generation meets verification: Accelerating large lan- guage model inference with smart parallel auto-correct decoding","venue":null,"work_id":"b8f8e9ac-fd34-444d-a3eb-bfaab4d68e74","year":2024},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.998289Z"},"links":{"citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:7eeb86ef2e2f27016da9a1522b30ad8297bb47600011724a82c243a26b546986","observation_id":"570e4780-b17d-4ada-a99c-8c36d0044fc8","resolution":{"observed_at":"2026-08-08T16:12:29.494735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-08T16:12:29.003107Z","title":"Zheng, L., Chiang, W.-L., Sheng, Y ., Zhuang, S., Wu, Z., Zhuang, Y ., Lin, Z., Li, Z., Li, D., Xing, E., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:29.003107Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:d05080f89f9ace05290ca27df87215d249c6470e1218985211d8eb5877a85197","observation_id":"9955b05b-532c-4eca-98a7-0352464f36d9","resolution":{"observed_at":"2026-08-08T16:12:29.003107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-08T16:12:28.856639Z","title":"9 Jakiro Jaech, A., Kalai, A., Lerer, A., Richardson, A., El-Kishky, A., Low, A., Helyar, A., Madry, A., Beutel, A., Car- ney, A., et al","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.856639Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:52a82f2d3652dea38af6c09bad5cc75eeea662fa964ebfbba348d34a85245f52","observation_id":"ecc449cf-0676-4e5f-8f50-3ca8d813c063","resolution":{"observed_at":"2026-08-08T16:12:28.856639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:12:29.514702Z","title":"1162/neco.1994.6.2.181","venue":null,"work_id":"1395020b-420f-400f-9c0a-fdcf3c3399fc","year":1994},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.866995Z"},"links":{"citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:35579db84063265aa9e8197761c8605ac39c56a3c81fc965424f6d0d94c12496","observation_id":"49ccf0ad-a702-4ade-b574-6480e58bd482","resolution":{"observed_at":"2026-08-08T16:12:29.519818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09117","last_updated":"2023-09-29T15:11:49Z","snapshot_observed_at":"2026-08-04T19:24:17.623767Z","submitted_at":"2023-09-17T00:29:32Z","title":"Contrastive Decoding Improves Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09117","snapshot_observed_at":"2026-08-08T16:12:28.944851Z","title":"and Lewis, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.944851Z"},"links":{"cited_paper":"/paper/2309.09117","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:d6345d3ce87b6392a0772bfeef6cb286c73cb97648c7cd1020ea4faa902c6386","observation_id":"c6174ef1-abbd-4bb5-946a-8c8cad82e328","resolution":{"observed_at":"2026-08-08T16:12:28.944851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14507","last_updated":"2024-11-02T06:14:55Z","snapshot_observed_at":"2026-08-01T23:38:39.309099Z","submitted_at":"2024-05-23T12:45:29Z","title":"Unchosen Experts Can Contribute Too: Unleashing MoE Models' Power by Self-Contrast","version":2},"cited_work":{"arxiv_id":"2405.14507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14507","snapshot_observed_at":"2026-08-08T16:12:29.129377Z","title":"Unchosen Experts Can Contribute Too: Unleashing MoE Models' Power by Self-Contrast","venue":"cs.CL","work_id":"73c37f91-5296-487d-819c-05a0425413eb","year":2024},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.972293Z"},"links":{"cited_paper":"/paper/2405.14507","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:6a5584984402224bdaca0bc02e4cada7917967d96ec5a3612729488f2ad7d96a","observation_id":"a21879fa-9f4a-431d-874f-8d328aec1310","resolution":{"observed_at":"2026-08-08T16:12:29.136455Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04970","last_updated":"2021-06-09T10:30:59Z","snapshot_observed_at":"2026-07-06T11:17:31.238458Z","submitted_at":"2021-06-09T10:30:59Z","title":"Instantaneous Grammatical Error Correction with Shallow Aggressive Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04970","snapshot_observed_at":"2026-08-08T16:12:28.978206Z","title":"Instantaneous gram- matical error correction with shallow aggressive decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.978206Z"},"links":{"cited_paper":"/paper/2106.04970","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:1e46222c0fd0cbe67ce662b67ffd841afa19dad75d8ce12edcafa30e93529b74","observation_id":"1fe85545-1999-42b1-9176-8a732949e3b6","resolution":{"observed_at":"2026-08-08T16:12:28.978206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-08T16:12:28.826267Z","title":"Gloeckle, F., Idrissi, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.826267Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:20cc507cf53f27ef6eeff3e64bd9e15997db69c25ca82f6043906e8082e99722","observation_id":"57464e7c-6901-4ed4-8eea-db7ab24109e1","resolution":{"observed_at":"2026-08-08T16:12:28.826267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:12:29.530112Z","title":"Stablemoe: Stable routing strategy for mixture of experts","venue":null,"work_id":"b5f3f9d6-3a95-4cda-a5d2-01c368078114","year":2022},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.742751Z"},"links":{"citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:c7cc088e4e150b49baf4ac6f3696a1a593c26baf2e067a50e29692d4f1c941a9","observation_id":"c8ef77de-1e96-46c5-b767-7d30a30e71a6","resolution":{"observed_at":"2026-08-08T16:12:29.535269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-08T16:12:28.678565Z","title":"D., Chen, D., and Dao, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.678565Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:d5b3865991d82d25eb23ca5d3126e374c6156ce9ff3873de361e5cce36fac8d2","observation_id":"c9cea444-63b4-48fe-82cf-0ee6ddb737e8","resolution":{"observed_at":"2026-08-08T16:12:28.678565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T16:12:28.725560Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.725560Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:28ff447b8ce54a9dd585fd853727eb0a4e1ae114b3859b6d35ea114c85d4382a","observation_id":"886a97bc-2c02-4d90-8038-ce236e2d5a4a","resolution":{"observed_at":"2026-08-08T16:12:28.725560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01171","last_updated":"2023-01-09T23:49:03Z","snapshot_observed_at":"2026-08-10T02:07:35.448026Z","submitted_at":"2022-04-03T22:28:31Z","title":"Why Exposure Bias Matters: An Imitation Learning Perspective of Error Accumulation in Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01171","snapshot_observed_at":"2026-08-08T16:12:28.631982Z","title":"E., Bahuleyan, H., and Cheung, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T16:12:28.631982Z"},"links":{"cited_paper":"/paper/2204.01171","citing_paper":"/paper/2502.06282"},"observation_digest":"sha256:21811197253ca6c2439b46cd688ce61246e3e7aa5af74c8d0d641b350b95277e","observation_id":"fe40e5e0-e9ef-4347-887d-1329cbbe5dab","resolution":{"observed_at":"2026-08-08T16:12:28.631982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06282","last_updated":"2025-02-10T09:24:06Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T23:05:46.857616Z","submitted_at":"2025-02-10T09:24:06Z","title":"Jakiro: Boosting Speculative Decoding with Decoupled Multi-Head via MoE"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 3 inbound Pith citation observations for arXiv:2502.06282."}