{"as_of":"2026-08-10T12:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c185d4ac89f3824eddd009c677b6b412b48205a192d052582ed2fb5dca91a38e","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:43:55.953976Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.24050/citation-record","integrity":"/paper/2509.24050/integrity","json":"/paper/2509.24050/citation-record.json","paper":"/paper/2509.24050"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T14:43:53.762733Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:53.762733Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:3321b3d74bfaea6c07897c56d7b4a15cf10a7982af28698e4c5731e41f526722","observation_id":"6294805d-9f52-465e-a7b5-ffb76721b9ff","resolution":{"observed_at":"2026-08-04T14:43:53.762733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02829","last_updated":"2025-06-08T00:57:21Z","snapshot_observed_at":"2026-07-06T19:45:21.541944Z","submitted_at":"2024-11-05T06:00:27Z","title":"CE-CoLLM: Efficient and Adaptive Large Language Models Through Cloud-Edge Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02829","snapshot_observed_at":"2026-08-04T14:43:54.496833Z","title":"CE-collm: Efficient and adaptive large language models through cloud-edge collaboration.arXiv preprint arXiv:2411.02829,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.496833Z"},"links":{"cited_paper":"/paper/2411.02829","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:d653b642ccc01673f84c6ba7f7c3c14748d32ca46e3dd20ab034ee998c924a0d","observation_id":"362a7aa6-3502-458b-9d6f-cd33b3dc6442","resolution":{"observed_at":"2026-08-04T14:43:54.496833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.834871Z","title":"Routing to the expert: Efficient reward-guided ensemble of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.834871Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:f45a01b5adb65fb85995d1e27526e1c3865f84d08d9d0099d9f9debbdd276dbb","observation_id":"e79cee0f-e56e-4a7d-8ace-642e78c8d546","resolution":{"observed_at":"2026-08-04T14:43:54.834871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.986258Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.986258Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:6f5a2a8e622ec636d20a744dc7c65946b25c8fdaf1d108023d6a5f79c2404840","observation_id":"9b3cfade-80e9-4e5d-b256-1d9af198ecac","resolution":{"observed_at":"2026-08-04T14:43:54.986258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T14:43:55.162713Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.162713Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:3fc927c278c0c35226a6a291e0f8f4fb46a92c7770413c050c70cddc77c140ad","observation_id":"63d3f026-4875-4e12-b017-8b2e9b499ec6","resolution":{"observed_at":"2026-08-04T14:43:55.162713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06925","last_updated":"2024-10-08T07:46:47Z","snapshot_observed_at":"2026-08-09T06:57:17.341983Z","submitted_at":"2024-02-10T11:14:53Z","title":"A Thorough Examination of Decoding Methods in the Era of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06925","snapshot_observed_at":"2026-08-04T14:43:55.322520Z","title":"A thorough examination of decoding methods in the era of llms.arXiv preprint arXiv:2402.06925,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.322520Z"},"links":{"cited_paper":"/paper/2402.06925","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:24727c6c9df082c55dc7e8c263a69141fda99b00f3454f0e9be2ca6ce619a103","observation_id":"56eaaeb7-ba01-40e4-bdd9-7fbe2694f17f","resolution":{"observed_at":"2026-08-04T14:43:55.322520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T14:43:55.450205Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.450205Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:75309acf5b23ada0c84e00058cfae7ca3d5abaf022058128250fa8936115c6a6","observation_id":"e601e73e-0d00-4f07-b679-a059b0e6583d","resolution":{"observed_at":"2026-08-04T14:43:55.450205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-08-10T07:52:08.606999Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-04T14:43:55.538761Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.538761Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:30267d9aee39842ff48c15915b962241ff7105965165c9ab5a90d6eba36d35b5","observation_id":"2ea04f92-1cbd-4b9d-a662-418fd2dad359","resolution":{"observed_at":"2026-08-04T14:43:55.538761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11007","last_updated":"2026-07-10T21:32:42Z","snapshot_observed_at":"2026-08-09T08:07:35.716774Z","submitted_at":"2025-02-16T06:18:28Z","title":"Device-Cloud Collaborative LLM Inference with Multi-Modal, Multi-Task, Multi-Turn Conversations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11007","snapshot_observed_at":"2026-08-04T14:43:55.719733Z","title":"Local-cloud infer- ence offloading for LLMs in multi-modal, multi-task, multi-dialogue settings.arXiv preprint arXiv:2502.11007,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.719733Z"},"links":{"cited_paper":"/paper/2502.11007","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:e3cc9ccc787db4c569ce2f2c56f6d250b9bd89b89370fe7c3b6103084f47b425","observation_id":"0c7773f0-9bd1-42a8-b13b-87268b176017","resolution":{"observed_at":"2026-08-04T14:43:55.719733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-04T14:43:55.821657Z","title":"Fine-tuning language models from human preferences.arXiv preprint arXiv:1909.08593,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.821657Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:c4ddb51b63aab0aee2da12cb4fc7cabb9e07102b1899d51436439dc1d753ead8","observation_id":"d3a2ff3b-2304-4c1e-9fbd-aa985898ff4e","resolution":{"observed_at":"2026-08-04T14:43:55.821657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:55.953976Z","title":"The Countdown task is an arith- metic puzzle where the model must combine a given set of numbers using basic arithmetic operations (+,−,×,÷) to reach a specified target number","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.953976Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:8ba1bc2582e22061cdebb09f9e709b1e326a5d5ad0c453504dadb7a8f328f008","observation_id":"7cd9ffc5-2071-4047-82ef-8c7574928987","resolution":{"observed_at":"2026-08-04T14:43:55.953976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00088","last_updated":"2024-09-14T04:01:09Z","snapshot_observed_at":"2026-08-09T15:51:34.120794Z","submitted_at":"2024-08-26T03:33:36Z","title":"On-Device Language Models: A Comprehensive Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00088","snapshot_observed_at":"2026-08-04T14:43:55.645299Z","title":"On-device language models: A comprehensive review.arXiv preprint arXiv:2409.00088,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.645299Z"},"links":{"cited_paper":"/paper/2409.00088","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:0476762c7e665ef31f63c46cab9a6a9a3d23be5052679d05a062917471322e84","observation_id":"26c784c6-9798-4e4f-ad24-e1fb01660bab","resolution":{"observed_at":"2026-08-04T14:43:55.645299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-04T14:43:54.119424Z","title":"Frugalgpt: How to use large language models while reducing cost and improving performance.arXiv preprint arXiv:2305.05176,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.119424Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:71048b0b1a5b7427b18f28a55c88a871368a5afe7200fe6d7a5dc94b39e011de","observation_id":"972cc23e-17cd-4882-8b96-d058ae7f201d","resolution":{"observed_at":"2026-08-04T14:43:54.119424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.008788Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.008788Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:27e90dfc7d33b88ccc2e9d4640dffa2e8ff8ecf5b59abcca4dc8285dd1390b21","observation_id":"dd503892-46af-4e2e-b307-b2c81be56dd0","resolution":{"observed_at":"2026-08-04T14:43:54.008788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-04T14:43:54.655669Z","title":"Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 13(9):9, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.655669Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:24104a7b2203cba17c8cd6313d16f509a9d767c73fcb7d26ce3bf8e9b29a5917","observation_id":"ccbc9f12-93f1-4be4-84a2-4a2f3e852ef0","resolution":{"observed_at":"2026-08-04T14:43:54.655669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14740","last_updated":"2024-02-26T18:26:25Z","snapshot_observed_at":"2026-08-09T14:30:33.899591Z","submitted_at":"2024-02-22T17:52:34Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14740","snapshot_observed_at":"2026-08-04T14:43:53.869680Z","title":"Back to basics: Revisiting reinforce style optimization for learn- ing from human feedback in LLMs.arXiv preprint arXiv:2402.14740,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:53.869680Z"},"links":{"cited_paper":"/paper/2402.14740","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:6573399c78f60a48de45e5d9217c3c50be1b5edd9e3ba587b79f3abe15567bf3","observation_id":"3e02e11a-adc3-4dd3-b7f1-1c1fa58b574f","resolution":{"observed_at":"2026-08-04T14:43:53.869680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19389","last_updated":"2026-05-23T21:24:55Z","snapshot_observed_at":"2026-08-09T20:13:49.471143Z","submitted_at":"2025-01-31T18:44:35Z","title":"Federated Sketching LoRA: A Flexible Framework for Heterogeneous Collaborative Fine-Tuning of LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19389","snapshot_observed_at":"2026-08-04T14:43:54.224975Z","title":"Federated sketching LoRA: On-device collaborative fine-tuning of large language models.arXiv preprint arXiv:2501.19389,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.224975Z"},"links":{"cited_paper":"/paper/2501.19389","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:0005ad7b4c2cc8645e49d011c30396323a21acd25586cec8171cb20d9f59d94b","observation_id":"34404daf-c9dd-4db4-94bb-db3556637f08","resolution":{"observed_at":"2026-08-04T14:43:54.224975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-04T14:43:54.378053Z","title":"Deberta: Decoding-enhanced bert with disentangled attention.arXiv preprint arXiv:2006.03654,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.378053Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:202e3964d3a1ef2b1305ab3e6e0fb43dd09bbc0ffb7022176d584fa322693352","observation_id":"a0fefbed-76c6-4d8e-8c6d-f2fc7168b50a","resolution":{"observed_at":"2026-08-04T14:43:54.378053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T08:00:21.862835Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2509.24050."}