{"as_of":"2026-08-09T01:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:395fe2032c4386abec8a1b0245544388ad0831e3e5774cc02cf8f63381e7ac33","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:11:44.679976Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.08020/citation-record","integrity":"/paper/2502.08020/integrity","json":"/paper/2502.08020/citation-record.json","paper":"/paper/2502.08020"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T11:11:44.544426Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.544426Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:f95481c5818061d4018b577d159767e7de1d473c26abddbaa19a47db022dc7f5","observation_id":"f1c88063-e920-424e-9a23-aca66e854004","resolution":{"observed_at":"2026-08-08T11:11:44.544426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T11:11:44.566293Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.566293Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:b3226ffe0746933de42fcea543a4a7c4bb980915768dfc94a89cc12c70c24520","observation_id":"fe2f73eb-d4f4-4090-87c3-bd7602e0a2d2","resolution":{"observed_at":"2026-08-08T11:11:44.566293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-08T01:15:44.293937Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-08T11:11:44.570486Z","title":"Layer skip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.570486Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:df2d05270a07611f99c358fcd030c97fdba371065037a7d9798889bfce8aa99f","observation_id":"02401361-2175-4902-a5cc-ac6e24047b05","resolution":{"observed_at":"2026-08-08T11:11:44.570486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13257","last_updated":"2025-01-09T22:21:56Z","snapshot_observed_at":"2026-08-02T11:25:49.310871Z","submitted_at":"2024-03-20T02:38:01Z","title":"Arcee's MergeKit: A Toolkit for Merging Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13257","snapshot_observed_at":"2026-08-08T11:11:44.574179Z","title":"Arcee’s mergekit: A toolkit for merging large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.574179Z"},"links":{"cited_paper":"/paper/2403.13257","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:8699bfefc8ef481d1c236d45d720af9c7fe10bf6810d85db37f517e84021e5b1","observation_id":"ef4643f8-036c-425e-a74f-17ed7d626ae7","resolution":{"observed_at":"2026-08-08T11:11:44.574179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11009","last_updated":"2024-06-25T22:35:07Z","snapshot_observed_at":"2026-08-07T08:56:19.559738Z","submitted_at":"2024-06-25T22:35:07Z","title":"CharED: Character-wise Ensemble Decoding for Large Language Models","version":1},"cited_work":{"arxiv_id":"2407.11009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11009","snapshot_observed_at":"2026-08-08T11:11:44.986233Z","title":"CharED: Character-wise Ensemble Decoding for Large Language Models","venue":"cs.CL","work_id":"d77c216e-e68f-41ae-846e-29d7459c0e47","year":2024},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.578176Z"},"links":{"cited_paper":"/paper/2407.11009","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:1a049c18e4b85d5d8065210740c16f439ff302fe558d2d5e74d2d5be25ab3d90","observation_id":"74effaa4-f223-4aff-b597-3a67b4a55f62","resolution":{"observed_at":"2026-08-08T11:11:44.990466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-08T11:11:44.581783Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.581783Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:d21c863305a7a2e2a816924a4fc0643ac6169030d7a4176b3eb41675cb2c4da2","observation_id":"cd165eb8-2c2f-48a2-941d-18167b7bed3d","resolution":{"observed_at":"2026-08-08T11:11:44.581783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08252","last_updated":"2024-04-04T11:37:01Z","snapshot_observed_at":"2026-07-06T16:47:24.765597Z","submitted_at":"2023-11-14T15:43:47Z","title":"REST: Retrieval-Based Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08252","snapshot_observed_at":"2026-08-08T11:11:44.585657Z","title":"D., and He, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.585657Z"},"links":{"cited_paper":"/paper/2311.08252","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:db22917f351d54452ebf1c69788516e73688647420d33a376478ec7103498774","observation_id":"8294b9c4-0386-42d3-bf90-a250a678b6ab","resolution":{"observed_at":"2026-08-08T11:11:44.585657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T11:11:44.589369Z","title":"Measuring mas- sive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.589369Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:52e4983a52303475357517577e22d10246928aec6103a18fb5b0788ff675af63","observation_id":"5e26a74a-f867-4f6f-b5ee-c3e1726addef","resolution":{"observed_at":"2026-08-08T11:11:44.589369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T11:11:44.597320Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.597320Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:f481f4cdf36299609c6bcff519e7d7c86dae2f1977f796e43dea423c57268020","observation_id":"58036a07-7914-4ce7-82b4-06e2650c5d25","resolution":{"observed_at":"2026-08-08T11:11:44.597320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15166","last_updated":"2024-04-04T01:53:38Z","snapshot_observed_at":"2026-08-02T22:58:10.491259Z","submitted_at":"2023-12-23T05:11:37Z","title":"SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15166","snapshot_observed_at":"2026-08-08T11:11:44.600880Z","title":"Solar 10.7 b: Scaling large language models with simple yet effective depth up-scaling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.600880Z"},"links":{"cited_paper":"/paper/2312.15166","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:f54ec256b535d5aec2c35e71825d72758e01cd023a804a3a1bb51bb5366142a6","observation_id":"f5d946a5-ce6d-4e39-ad76-8bec83e82c11","resolution":{"observed_at":"2026-08-08T11:11:44.600880Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19325","last_updated":"2025-04-25T01:08:35Z","snapshot_observed_at":"2026-07-06T18:22:10.094519Z","submitted_at":"2024-05-29T17:55:03Z","title":"Nearest Neighbor Speculative Decoding for LLM Generation and Attribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19325","snapshot_observed_at":"2026-08-08T11:11:44.604539Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.604539Z"},"links":{"cited_paper":"/paper/2405.19325","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:36e831e889ca53475200088df78eec31098a41b8b69899f2d2755836398fdecd","observation_id":"8155c263-900f-463b-bca9-60a5013e2078","resolution":{"observed_at":"2026-08-08T11:11:44.604539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-08T11:11:44.608838Z","title":"Truthfulqa: Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.608838Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:3439a297214d4cd23205b38d24eb410772916e111dcf1932f55f96907bfec340","observation_id":"b08be297-1449-4dfd-9263-120d214869a6","resolution":{"observed_at":"2026-08-08T11:11:44.608838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-08T11:11:44.612539Z","title":"Wizard- math: Empowering mathematical reasoning for large lan- guage models via reinforced evol-instruct","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.612539Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:b1f72db7e3222a06f1d24046d3fa5dd8b96ee10a44988942374615902520bc98","observation_id":"c33c23c0-a3e2-46e5-bad9-3c707f678f44","resolution":{"observed_at":"2026-08-08T11:11:44.612539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-07-06T15:28:24.682211Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-08T11:11:44.616267Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.616267Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:6cdf6ccdaef1f237fc8d624292b77a101537a5c65c1bf3089d7063fede9ee7ec","observation_id":"d3459bcc-ba0c-4930-9bdb-c49e0dd33885","resolution":{"observed_at":"2026-08-08T11:11:44.616267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-07-30T15:06:18.011623Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-08-08T11:11:44.619720Z","title":"E., Kadous, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.619720Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:fc02516f395174e534af8fc1380e5c30c4fed52d99d46eeafc8ccd90efbebfb1","observation_id":"318c6d8a-22e0-450d-9c13-d5dbcfaef349","resolution":{"observed_at":"2026-08-08T11:11:44.619720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14992","last_updated":"2024-05-26T22:27:23Z","snapshot_observed_at":"2026-08-05T12:01:06.707349Z","submitted_at":"2024-02-22T22:05:23Z","title":"tinyBenchmarks: evaluating LLMs with fewer examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14992","snapshot_observed_at":"2026-08-08T11:11:44.623525Z","title":"M., Weber, L., Choshen, L., Sun, Y ., Xu, G., and Yurochkin, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.623525Z"},"links":{"cited_paper":"/paper/2402.14992","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:404eb86821ed7a4eb6478975dde3d0afd982be8c78e1b31ff6e2f14e9c9910e9","observation_id":"b7e3a1d0-600e-4ddb-a448-84fe9dbb1dcd","resolution":{"observed_at":"2026-08-08T11:11:44.623525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03870","last_updated":"2024-08-27T08:31:04Z","snapshot_observed_at":"2026-07-06T17:40:33.769700Z","submitted_at":"2024-03-06T17:23:28Z","title":"Learning to Decode Collaboratively with Multiple Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03870","snapshot_observed_at":"2026-08-08T11:11:44.627016Z","title":"Z., Lang, H., Wang, B., Kim, Y ., and Sontag, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.627016Z"},"links":{"cited_paper":"/paper/2403.03870","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:71921f89332cb70d025038265052eeb1deef142385f68e748c4064a38aadb4ad","observation_id":"e738b2c6-01bb-42f5-99ca-b0dbfa6622b1","resolution":{"observed_at":"2026-08-08T11:11:44.627016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10491","last_updated":"2024-01-22T17:16:37Z","snapshot_observed_at":"2026-08-04T23:37:08.155969Z","submitted_at":"2024-01-19T05:02:46Z","title":"Knowledge Fusion of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10491","snapshot_observed_at":"2026-08-08T11:11:44.634199Z","title":"Knowledge fusion of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.634199Z"},"links":{"cited_paper":"/paper/2401.10491","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:cd5e601cace19f97deff1013e6326de74a4a500d11482d3d793a9293463b3a3c","observation_id":"8e349a1d-dae5-4151-971b-bc1dd2e68b9e","resolution":{"observed_at":"2026-08-08T11:11:44.634199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06440","last_updated":"2020-02-15T20:09:24Z","snapshot_observed_at":"2026-08-06T14:46:34.371139Z","submitted_at":"2020-02-15T20:09:24Z","title":"Federated Learning with Matched Averaging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06440","snapshot_observed_at":"2026-08-08T11:11:44.638040Z","title":"Federated learning with matched averaging","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.638040Z"},"links":{"cited_paper":"/paper/2002.06440","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:f243a96fdcf08d88c7e9b770175fcae48441b5006efa2e64dc70973e4bd9258b","observation_id":"7e61f48a-c519-4174-886d-2ad60b69a50e","resolution":{"observed_at":"2026-08-08T11:11:44.638040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01542","last_updated":"2024-05-09T16:04:20Z","snapshot_observed_at":"2026-07-06T16:26:46.131908Z","submitted_at":"2023-10-02T18:31:35Z","title":"Fusing Models with Complementary Expertise","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01542","snapshot_observed_at":"2026-08-08T11:11:44.641988Z","title":"M., Sun, Y ., Kundu, S., Xing, E., and Yurochkin, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.641988Z"},"links":{"cited_paper":"/paper/2310.01542","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:ad2b2674d6cef1b77b1c786528a72564df607bfd73f63fdb82cc7f92c3d10293","observation_id":"40e10578-8a23-49d9-b8a1-79251b34e779","resolution":{"observed_at":"2026-08-08T11:11:44.641988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02415","last_updated":"2024-05-30T04:45:34Z","snapshot_observed_at":"2026-08-08T22:37:20.916283Z","submitted_at":"2024-01-04T18:59:12Z","title":"LLaMA Pro: Progressive LLaMA with Block Expansion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02415","snapshot_observed_at":"2026-08-08T11:11:44.645850Z","title":"Llama pro: Progressive llama with block expansion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.645850Z"},"links":{"cited_paper":"/paper/2401.02415","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:aa36a768c187c3583e59ca896dac3d9a561132237ee02a72aac6f44132f3c44c","observation_id":"b34b07c6-e9dd-4733-afff-3155b3b24259","resolution":{"observed_at":"2026-08-08T11:11:44.645850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:11:45.075414Z","title":"Speculative decoding: Exploiting speculative execu- tion for accelerating seq2seq generation","venue":null,"work_id":"a1fa3e79-7556-4d04-b06d-623d871b444c","year":2023},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.649541Z"},"links":{"citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:41d6581307c89d96f09fbc3969a5f6255b295792f18f04a1d804362d34d9b10e","observation_id":"40f3ccc8-a460-4563-9ac9-7a62da980de5","resolution":{"observed_at":"2026-08-08T11:11:45.079656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07851","last_updated":"2024-06-04T17:08:37Z","snapshot_observed_at":"2026-07-06T17:15:46.395218Z","submitted_at":"2024-01-15T17:26:50Z","title":"Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07851","snapshot_observed_at":"2026-08-08T11:11:44.653199Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.653199Z"},"links":{"cited_paper":"/paper/2401.07851","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:32e3c3cbc66f5d1fa4cb5434d2e11b86ff7faefab292d6c2a87f686aa323fbf0","observation_id":"4b6a643e-a163-4897-818a-5763be994129","resolution":{"observed_at":"2026-08-08T11:11:44.653199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01739","last_updated":"2024-03-27T10:21:24Z","snapshot_observed_at":"2026-08-02T08:17:59.108390Z","submitted_at":"2024-01-29T12:05:02Z","title":"OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01739","snapshot_observed_at":"2026-08-08T11:11:44.656931Z","title":"Openmoe: An early effort on open mixture-of-experts language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.656931Z"},"links":{"cited_paper":"/paper/2402.01739","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:65e4943bee5ce2a96bdf609d5090a80b272b943b34393ce80a0ee05ab0fc214e","observation_id":"bf853922-cfcb-4687-a7de-72a0d0581b14","resolution":{"observed_at":"2026-08-08T11:11:44.656931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05908","last_updated":"2024-07-29T04:03:22Z","snapshot_observed_at":"2026-07-06T15:53:03.616093Z","submitted_at":"2023-07-12T04:28:41Z","title":"Predictive Pipelined Decoding: A Compute-Latency Trade-off for Exact LLM Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05908","snapshot_observed_at":"2026-08-08T11:11:44.660620Z","title":"Predictive pipelined decoding: A compute- latency trade-off for exact llm decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.660620Z"},"links":{"cited_paper":"/paper/2307.05908","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:9d10bcf440e36da6b86099cbbbae2f3987549185d7e78359125c9ea813888fc3","observation_id":"cd65d410-14f6-4eaa-9746-915eb3f41109","resolution":{"observed_at":"2026-08-08T11:11:44.660620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-07-31T00:09:56.948833Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-08T11:11:44.664644Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.664644Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:5a38dd507fdea9ece9361eb766ce2e11a4612cd6883b6ad374c292d6404c89df","observation_id":"64e82450-681d-4c0e-a5d8-ab5eaf12af0a","resolution":{"observed_at":"2026-08-08T11:11:44.664644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-08T11:11:44.672626Z","title":"Tinyllama: An open-source small language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.672626Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:bb59ff1f3865f46de59a9e8abb92adffb0c6e2447b34839162a25b458213b59a","observation_id":"df442e90-9acb-4880-8538-07ae015a6601","resolution":{"observed_at":"2026-08-08T11:11:44.672626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08461","last_updated":"2024-03-31T03:06:51Z","snapshot_observed_at":"2026-08-06T22:36:42.010627Z","submitted_at":"2023-10-12T16:21:04Z","title":"DistillSpec: Improving Speculative Decoding via Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08461","snapshot_observed_at":"2026-08-08T11:11:44.676440Z","title":"S., Menon, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.676440Z"},"links":{"cited_paper":"/paper/2310.08461","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:981891a085c9fa45f0ab46e88f45ead0f93a723a45cd0346d21412c60ebc0cf9","observation_id":"c13cc53f-76d5-4775-be7a-e2b7ecdc3e84","resolution":{"observed_at":"2026-08-08T11:11:44.676440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16554","last_updated":"2024-06-24T11:43:07Z","snapshot_observed_at":"2026-08-07T07:41:30.267453Z","submitted_at":"2024-06-24T11:43:07Z","title":"LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16554","snapshot_observed_at":"2026-08-08T11:11:44.679976Z","title":"Llama-moe: Building mixture-of-experts from llama with continual pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.679976Z"},"links":{"cited_paper":"/paper/2406.16554","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:3901465abefc6a4d1777cc1ffcdc19ddfb381570708b1da7557d70f9271b54e7","observation_id":"8f6bc54d-51fa-4d30-a039-f45eec127b6c","resolution":{"observed_at":"2026-08-08T11:11:44.679976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T11:11:44.630374Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.630374Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:41cf70debbf35d7a43eb2554cb05938e7fda6272b83d6163e1a48f605d4daefb","observation_id":"72c7d422-84b5-46d2-83e1-2774e256cb9a","resolution":{"observed_at":"2026-08-08T11:11:44.630374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08168","last_updated":"2024-05-20T02:37:20Z","snapshot_observed_at":"2026-07-06T16:18:49.258642Z","submitted_at":"2023-09-15T05:34:32Z","title":"Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08168","snapshot_observed_at":"2026-08-08T11:11:44.668944Z","title":"Draft & verify: Lossless large language model acceleration via self-speculative decoding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.668944Z"},"links":{"cited_paper":"/paper/2309.08168","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:11ae4a49a7e23fbcd0742add49da50f223ff2f885a048486588dd267a3ebf122","observation_id":"d6ce2fff-505c-46e5-915d-2f6178d92b1e","resolution":{"observed_at":"2026-08-08T11:11:44.668944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04051","last_updated":"2025-04-08T02:23:05Z","snapshot_observed_at":"2026-07-06T17:26:14.973632Z","submitted_at":"2024-02-06T14:53:28Z","title":"Analysis of Linear Mode Connectivity via Permutation-Based Weight Matching: With Insights into Other Permutation Search Methods","version":5},"cited_work":{"arxiv_id":"2402.04051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.04051","snapshot_observed_at":"2026-08-08T11:11:44.933737Z","title":"Analysis of Linear Mode Connectivity via Permutation-Based Weight Matching: With Insights into Other Permutation Search Methods","venue":"cs.LG","work_id":"0995fe2e-1b6b-486c-8fa3-60149f2adf1c","year":2024},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.593522Z"},"links":{"cited_paper":"/paper/2402.04051","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:1a6e4a6bdde2f0040808ff46bc490c7dcd6755c6e0d49ea64874816872e46808","observation_id":"4e180fbc-8f5e-45de-a96f-b3b859ab0f9f","resolution":{"observed_at":"2026-08-08T11:11:44.940264Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T11:11:44.562217Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.562217Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:885cd1bca05a5be10f97fdabe0381a2e84af6b06adb5281d16f009529c16295f","observation_id":"c9f857e3-9ea8-4b2c-a035-cf3ef17643d1","resolution":{"observed_at":"2026-08-08T11:11:44.562217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:11:45.088207Z","title":"J., Ganesh, E","venue":null,"work_id":"900436d2-7d60-4af0-9f68-523bbb57013c","year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.553936Z"},"links":{"citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:bd8ad76da5e84b7578a4ba2d699077271aae41299d813ab6976f0faa05ccfa2e","observation_id":"7b4bd154-b336-4246-bad2-fefd95285e18","resolution":{"observed_at":"2026-08-08T11:11:45.092327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.04836","last_updated":"2023-03-01T22:17:16Z","snapshot_observed_at":"2026-07-06T13:50:57.502239Z","submitted_at":"2022-09-11T10:44:27Z","title":"Git Re-Basin: Merging Models modulo Permutation Symmetries","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.04836","snapshot_observed_at":"2026-08-08T11:11:44.549448Z","title":"K., Hayase, J., and Srinivasa, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.549448Z"},"links":{"cited_paper":"/paper/2209.04836","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:aec43794c083071ad34b2c14ecee453c7f6e472ed07ada3779d515221841c925","observation_id":"dbea834e-fc5d-4e3b-bb79-8f9cd4b472e5","resolution":{"observed_at":"2026-08-08T11:11:44.549448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-08T11:11:44.557990Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T11:11:44.557990Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2502.08020"},"observation_digest":"sha256:17d58c77335037008c3378841a312adad365b9d514f41d38dcfc057e59bfe69d","observation_id":"b4213b6b-6b4b-4ef6-ab25-734519ee4d56","resolution":{"observed_at":"2026-08-08T11:11:44.557990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.08020","last_updated":"2025-03-19T16:26:10Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T11:04:51.000535Z","submitted_at":"2025-02-11T23:40:53Z","title":"Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2502.08020."}