{"as_of":"2026-08-10T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eb814a17237875b08dca1b4053654b6051289a5e4acceb34de084d6e670b9013","coverage":[{"denominator":288,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:06:48.231805Z","state":"measured"},{"denominator":109,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":109,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:20:59.587952Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T21:53:59.101198Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-05T16:20:59.587952Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18725","last_updated":"2025-08-26T06:50:11Z","snapshot_observed_at":"2026-08-06T22:55:46.437867Z","submitted_at":"2025-08-26T06:50:11Z","title":"Toward Edge General Intelligence with Agentic AI and Agentification: Concepts, Technologies, and Future Directions","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-05T16:20:59.587952Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2508.18725"},"observation_digest":"sha256:7808565b11e2245b13ab74a69763bc4851f43b054724fe878064599c363667f8","observation_id":"4661de65-4c54-46ae-9ead-af3e3843e64c","resolution":{"observed_at":"2026-08-05T16:20:59.587952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-04T14:43:54.655669Z","title":"Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 13(9):9, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-10T12:27:50.716920Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.655669Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:d54229756dfbcedd76ede149ab1a00a4af042701e840faf6bc8c02ce1652b37c","observation_id":"ccbc9f12-93f1-4be4-84a2-4a2f3e852ef0","resolution":{"observed_at":"2026-08-04T14:43:54.655669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":"2507.16731","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-06-29T21:53:59.101198Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges","venue":null,"work_id":"69b873ac-d384-48eb-b914-8f576f056514","year":2025},"citing_paper":{"arxiv_id":"2603.27112","last_updated":"2026-04-23T14:57:50Z","snapshot_observed_at":"2026-08-08T15:30:57.911954Z","submitted_at":"2026-03-28T03:41:40Z","title":"RailVQA: A Benchmark and Framework for Efficient Interpretable Visual Cognition in Automatic Train Operation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-14T22:24:13.897439Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2603.27112"},"observation_digest":"sha256:94ae20664660199926bf41fee73710ac17cf9d4312a30adbb268ef32962ed413","observation_id":"3aa744cd-79f9-4374-958a-0e7c05cdaa3a","resolution":{"observed_at":"2026-05-14T22:28:04.749869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":"2507.16731","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-06-29T21:53:59.101198Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges","venue":null,"work_id":"69b873ac-d384-48eb-b914-8f576f056514","year":2025},"citing_paper":{"arxiv_id":"2604.07767","last_updated":"2026-04-09T03:43:54Z","snapshot_observed_at":"2026-08-03T04:37:14.161923Z","submitted_at":"2026-04-09T03:43:54Z","title":"Administrative Decentralization in Edge-Cloud Multi-Agent for Mobile Automation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:56:59.725937Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2604.07767"},"observation_digest":"sha256:1fd455568a6b7a5114ec7e8b5cb34dcb48678d1c5e93e06a265a6e8113412a14","observation_id":"890f9d7c-1e51-4e65-9172-0f07ffb30613","resolution":{"observed_at":"2026-05-11T05:46:12.943447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":"2507.16731","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-06-29T21:53:59.101198Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges","venue":null,"work_id":"69b873ac-d384-48eb-b914-8f576f056514","year":2025},"citing_paper":{"arxiv_id":"2604.17227","last_updated":"2026-04-19T03:20:30Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:20:30Z","title":"Cloud-native and Distributed Systems for Efficient and Scalable Large Language Models -- A Research Agenda","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T06:27:23.580445Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2604.17227"},"observation_digest":"sha256:794d8ba7bca2e83abc60628ad4774306177b4796dc1e0f22c15b3050711d508a","observation_id":"136e5946-975c-43d6-948e-22a5ef67db2d","resolution":{"observed_at":"2026-05-10T06:31:30.807812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":"2507.16731","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-06-29T21:53:59.101198Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges","venue":null,"work_id":"69b873ac-d384-48eb-b914-8f576f056514","year":2025},"citing_paper":{"arxiv_id":"2605.16630","last_updated":"2026-05-19T13:37:41Z","snapshot_observed_at":"2026-07-06T23:27:43.762904Z","submitted_at":"2026-05-15T20:53:22Z","title":"PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T16:17:37.824542Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2605.16630"},"observation_digest":"sha256:e9ad3d51609d7cdd47c6d3b649c254678035bb29c419ebee4b9de62bf8350ff8","observation_id":"1876146e-6691-4946-a788-3bddb672a665","resolution":{"observed_at":"2026-05-20T16:18:37.500048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":"2507.16731","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-06-29T21:53:59.101198Z","title":"Collaborative inference and learning between edge slms and cloud llms: A survey of algorithms, execution, and open challenges","venue":null,"work_id":"69b873ac-d384-48eb-b914-8f576f056514","year":2025},"citing_paper":{"arxiv_id":"2605.25716","last_updated":"2026-05-25T11:18:19Z","snapshot_observed_at":"2026-08-07T06:58:12.897980Z","submitted_at":"2026-05-25T11:18:19Z","title":"An Efficient and Privacy-Preserving Architecture for Cross-Institutional Collaborative RAG","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T21:52:49.508434Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2605.25716"},"observation_digest":"sha256:f22ca2f0c4a40b78ae7343b41c4fa235e818c5b597048c38c102fa25d17defdc","observation_id":"9902e717-f356-43b6-b8a9-69fa45a02cea","resolution":{"observed_at":"2026-06-29T21:53:59.102659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-02T06:42:15.915097Z","title":"Collaborative inference and learning between edge SLMs and cloud LLMs: A survey.arXiv preprint arXiv:2507.16731, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13093","last_updated":"2026-07-14T01:17:17Z","snapshot_observed_at":"2026-08-08T10:48:10.083642Z","submitted_at":"2026-07-14T01:17:17Z","title":"Efficient and Privacy Aware Edge Cloud Collaborative Inference for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:42:15.915097Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2607.13093"},"observation_digest":"sha256:5484afaf27066c38e826e7fedf4898d82051b4f5c0add9c0dcf09f55aefbc1c0","observation_id":"a7e64c04-0db6-4448-8b9c-9944903863d4","resolution":{"observed_at":"2026-08-02T06:42:15.915097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-01T10:14:14.063270Z","title":"Senyao Li, Haozhao Wang, Wenchao Xu, Rui Zhang, Song Guo, Jingling Yuan, Xian Zhong, Tianwei Zhang, and Ruixuan Li","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20327","last_updated":"2026-07-22T16:14:26Z","snapshot_observed_at":"2026-08-07T18:49:46.472241Z","submitted_at":"2026-07-22T16:14:26Z","title":"PyroDash: Cost-Efficient Token-Level Small-Large Language Model Collaborative Inference","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T10:14:14.063270Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2607.20327"},"observation_digest":"sha256:1157d2360b540e2f201ec6648bb770f92309d0b9fa3653a28e4748be4849b151","observation_id":"0a404b17-ab33-40ef-b445-4eff6cb665a6","resolution":{"observed_at":"2026-08-01T10:14:14.063270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.16731/citation-record","integrity":"/paper/2507.16731/integrity","json":"/paper/2507.16731/citation-record.json","paper":"/paper/2507.16731"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.801619Z","title":"Online security-aware and reliability-guaranteed ai service chains provisioning in edge intelligence cloud","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.801619Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:4bd21409ae887d0c425051a5e4646f042a2a0365d3fd30f598260d87e3f79cc5","observation_id":"3ca209b4-721e-45b0-82d2-858871595f34","resolution":{"observed_at":"2026-08-06T15:06:47.801619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.806402Z","title":"Llm-based edge intelligence: A comprehensive survey on architectures, applications, security and trustworthiness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.806402Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3d8dfd736f4988e7f738922b6134f30303bcc178bcf78c5496e15a42f6592952","observation_id":"2d95df77-9278-4292-b87a-501076da8b0b","resolution":{"observed_at":"2026-08-06T15:06:47.806402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14030","last_updated":"2023-11-23T14:36:30Z","snapshot_observed_at":"2026-07-06T16:51:36.124532Z","submitted_at":"2023-11-23T14:36:30Z","title":"PrivateLoRA For Efficient Privacy Preserving LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14030","snapshot_observed_at":"2026-08-06T15:06:47.810584Z","title":"Privatelora for efficient privacy preserving llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.810584Z"},"links":{"cited_paper":"/paper/2311.14030","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3688bf2e1e8dcc02ac9904de01dd1cd3f335e00695eb284a207aa7d6e65ebb9d","observation_id":"62408183-0366-4f31-a299-92ea66d19bbb","resolution":{"observed_at":"2026-08-06T15:06:47.810584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.815986Z","title":"Mobile edge intelligence for large language models: A contemporary survey.IEEE Commun","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.815986Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c0feaf21cd79345330074ac2b56de6e524d57dd54928c7db22f5fe9a7b8ac07e","observation_id":"3c11d90d-83dc-43cf-bb2f-e94fd597f32a","resolution":{"observed_at":"2026-08-06T15:06:47.815986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.820048Z","title":"Multi-tier multi-node scheduling of LLM for collaborative AI computing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.820048Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:17bc9e72ecf7983392dc1fb2f63ae8b36849a31f7f7f07d84ea37d63b52bc7af","observation_id":"56963ccd-c9fd-4710-a4f1-cc06dd8f45ce","resolution":{"observed_at":"2026-08-06T15:06:47.820048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.824844Z","title":"Cambricon-llm: A chiplet-based hybrid architecture for on-device inference of 70b LLM","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.824844Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:930df593c6aca54d0bc8c2e5564070ec726480948f116f633766891e504c082b","observation_id":"e7a507da-f54b-410b-a5ff-a41060532684","resolution":{"observed_at":"2026-08-06T15:06:47.824844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06646","last_updated":"2024-10-30T03:41:42Z","snapshot_observed_at":"2026-08-09T02:56:45.757544Z","submitted_at":"2024-08-13T05:30:41Z","title":"Hybrid SD: Edge-Cloud Collaborative Inference for Stable Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06646","snapshot_observed_at":"2026-08-06T15:06:47.829373Z","title":"Hybrid sd: Edge-cloud collaborative inference for stable diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.829373Z"},"links":{"cited_paper":"/paper/2408.06646","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c68769da414efe3a7013244769725032b82a63334f4dbfe1185e7f81819a31cd","observation_id":"8251bcb3-ca9f-4830-b3e0-14d631d1ba35","resolution":{"observed_at":"2026-08-06T15:06:47.829373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04215","last_updated":"2024-10-12T12:50:33Z","snapshot_observed_at":"2026-07-06T16:03:54.971351Z","submitted_at":"2023-08-08T12:27:20Z","title":"Hybrid-RACA: Hybrid Retrieval-Augmented Composition Assistance for Real-time Text Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04215","snapshot_observed_at":"2026-08-06T15:06:47.834205Z","title":"Hybrid retrieval-augmented generation for real-time composition assistance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.834205Z"},"links":{"cited_paper":"/paper/2308.04215","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:66c778ce69fddd2df9b8095837b1e965c23e619310a282447930600f83c8d8f9","observation_id":"2d9a3116-2abc-4dae-969c-c04b481a1658","resolution":{"observed_at":"2026-08-06T15:06:47.834205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10361","last_updated":"2023-03-18T08:35:12Z","snapshot_observed_at":"2026-07-06T15:05:12.470716Z","submitted_at":"2023-03-18T08:35:12Z","title":"DC-CCL: Device-Cloud Collaborative Controlled Learning for Large Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10361","snapshot_observed_at":"2026-08-06T15:06:47.838796Z","title":"Dc-ccl: Device-cloud collaborative controlled learning for large vision models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.838796Z"},"links":{"cited_paper":"/paper/2303.10361","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:814fa995aefa43f8f53569bb298acd0349aa65320abfa8408b846b725306c56f","observation_id":"d8a59bcc-af3e-4842-bc3f-9f1a13736f8b","resolution":{"observed_at":"2026-08-06T15:06:47.838796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.843074Z","title":"Large language models (llms) inference offloading and resource allocation in cloud-edge networks: An active inference approach","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.843074Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3ce961715c81557578b601a70dcb9075298c6983afecb240b000aad24ca8cfa7","observation_id":"48a1e994-a5cd-4d79-bc64-793aeb41f5d1","resolution":{"observed_at":"2026-08-06T15:06:47.843074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.847232Z","title":"Crayon: Customized on-device llm via instant adapter blending and edge-server hybrid inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.847232Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:762c8fceac7784319f9304262146f59b8e675e5584329fcd982d352ad33e9e60","observation_id":"35ed8e35-475f-4382-903d-283156d43b09","resolution":{"observed_at":"2026-08-06T15:06:47.847232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02532","last_updated":"2024-11-30T21:33:59Z","snapshot_observed_at":"2026-07-06T18:25:22.852874Z","submitted_at":"2024-06-04T17:53:36Z","title":"SpecExec: Massively Parallel Speculative Decoding for Interactive LLM Inference on Consumer Devices","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02532","snapshot_observed_at":"2026-08-06T15:06:47.851506Z","title":"Specexec: Massively parallel speculative decoding for interactive llm inference on consumer devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.851506Z"},"links":{"cited_paper":"/paper/2406.02532","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3ef82c544dbc805350ee78b473da1fd848a66a931fb1552d418bc0f65230f59a","observation_id":"9dc860e1-309d-4dea-9d8a-324fadcb4e49","resolution":{"observed_at":"2026-08-06T15:06:47.851506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02829","last_updated":"2025-06-08T00:57:21Z","snapshot_observed_at":"2026-07-06T19:45:21.541944Z","submitted_at":"2024-11-05T06:00:27Z","title":"CE-CoLLM: Efficient and Adaptive Large Language Models Through Cloud-Edge Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02829","snapshot_observed_at":"2026-08-06T15:06:47.855749Z","title":"Ce-collm: Efficient and adaptive large language models through cloud-edge collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.855749Z"},"links":{"cited_paper":"/paper/2411.02829","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:7345ae36358d8ca65ddc690e1afecb8bb3c9dc05ceb09398fee1e2411c475025","observation_id":"b00c00ef-973d-423d-8753-57b5903ac6f0","resolution":{"observed_at":"2026-08-06T15:06:47.855749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.860087Z","title":"Hybrid slm and llm for edge-cloud collaborative inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.860087Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:cce2bfc12a76d2b6d7578ed3ff4a0d70a516ccf5108b549f747536f9a6e8a02a","observation_id":"b49a73d2-4d9c-414d-b648-682a628ae57d","resolution":{"observed_at":"2026-08-06T15:06:47.860087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.863912Z","title":"Efficient deployment of large language model across cloud-device systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.863912Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:cf684863eed930405eae54c3825c4161021b519ceb88747fcc0bc1a7fd02fb01","observation_id":"bf8ef859-c923-4fe0-a03f-36ca2036710b","resolution":{"observed_at":"2026-08-06T15:06:47.863912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19635","last_updated":"2024-05-30T02:37:35Z","snapshot_observed_at":"2026-08-05T13:53:37.028406Z","submitted_at":"2024-05-30T02:37:35Z","title":"GKT: A Novel Guidance-Based Knowledge Transfer Framework For Efficient Cloud-edge Collaboration LLM Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19635","snapshot_observed_at":"2026-08-06T15:06:47.867886Z","title":"Gkt: A novel guidance-based knowledge transfer framework for efficient cloud-edge collaboration llm deployment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.867886Z"},"links":{"cited_paper":"/paper/2405.19635","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3e0323054d173157de8da86f9a5ac99dd1857e73ccab39bbd6f06a2ae3dff1d0","observation_id":"c49c1075-66de-480e-b4f9-8b5588865c67","resolution":{"observed_at":"2026-08-06T15:06:47.867886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.871809Z","title":"Large language models empowered autonomous edge ai for connected intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.871809Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:8fb135848ff494db1fe1eda3cd8dcfe3878a1a1b98e0b1b5cbf5170264dd37de","observation_id":"8436d3ec-316b-4e93-99ab-0c8ce657915c","resolution":{"observed_at":"2026-08-06T15:06:47.871809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09410","last_updated":"2025-01-16T09:36:32Z","snapshot_observed_at":"2026-07-06T20:21:50.886212Z","submitted_at":"2025-01-16T09:36:32Z","title":"MoE$^2$: Optimizing Collaborative Inference for Edge Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09410","snapshot_observed_at":"2026-08-06T15:06:47.875762Z","title":"Moe2: Optimizing collaborative inference for edge large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.875762Z"},"links":{"cited_paper":"/paper/2501.09410","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:dbea930a929ce21c908cde69a8d2721d8bb736f8fa1bb1be3c8abb98bddf38c6","observation_id":"70db2372-76c3-471d-830d-f75024a99334","resolution":{"observed_at":"2026-08-06T15:06:47.875762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18082","last_updated":"2026-07-20T02:13:43Z","snapshot_observed_at":"2026-08-10T03:15:59.578608Z","submitted_at":"2024-06-26T05:40:10Z","title":"Octo-planner: On-device Language Model for Planner-Action Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18082","snapshot_observed_at":"2026-08-06T15:06:47.879783Z","title":"Octo-planner: On-device language model for planner-action agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.879783Z"},"links":{"cited_paper":"/paper/2406.18082","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:4f48171e278359be8f66784984203dfbf8abf1e2a714b6fff1b426c50a56d405","observation_id":"40940e70-b105-4f32-971f-dd5037d0694d","resolution":{"observed_at":"2026-08-06T15:06:47.879783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.884177Z","title":"A survey on model compression for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.884177Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:00a8e3ae70f3a8b07aa91ce3693292763f371f03ab6ebf44be9811a2a5fb6f6c","observation_id":"1c7ef846-9fc4-40fc-bf31-7347ed436c83","resolution":{"observed_at":"2026-08-06T15:06:47.884177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.888303Z","title":"Pushing up to the limit of memory bandwidth and capacity utilization for efficient llm decoding on embedded fpga","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.888303Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:63c3920802b173257314231e8d2c6bf341ac8cb06ed84e486f309f4878a65532","observation_id":"32f9cc99-fe6c-44de-8c0d-706648585558","resolution":{"observed_at":"2026-08-06T15:06:47.888303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.892060Z","title":"Scaling up on-device llms via active-weight swapping between dram and flash.arXiv preprint arXiv:2504.08378, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.892060Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:4022f397a29e4fbb52b53c3f5e99a6b7874c5358a8199f718808eb8c53709e8e","observation_id":"a1ad0552-5937-4a2a-821f-d52622cb3a43","resolution":{"observed_at":"2026-08-06T15:06:47.892060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.896655Z","title":"Understanding llms: A comprehensive overview from training to inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.896655Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:77138fa7a0b7a0224d9515660e2758ee27a010507643b86de202b9ee2adffc25","observation_id":"178c80d9-2465-463c-aca5-8305a0cef15e","resolution":{"observed_at":"2026-08-06T15:06:47.896655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.900495Z","title":"Large models for aerial edges: An edge-cloud model evolution and communication paradigm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.900495Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:08a74dc38d921d2140e4635b112f126e0a783fb055e088828752258ddbc7033c","observation_id":"16778823-bc27-4b33-8aa5-949ec5360dae","resolution":{"observed_at":"2026-08-06T15:06:47.900495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04255","last_updated":"2023-09-08T10:44:19Z","snapshot_observed_at":"2026-07-06T16:16:07.182657Z","submitted_at":"2023-09-08T10:44:19Z","title":"LLMCad: Fast and Scalable On-device Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04255","snapshot_observed_at":"2026-08-06T15:06:47.908155Z","title":"Llmcad: Fast and scalable on-device large language model inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.908155Z"},"links":{"cited_paper":"/paper/2309.04255","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:75feec228c72c90ce131248c3c06aa49b46c9363f296e00942fafd5e7e7a9138","observation_id":"c27dfe0c-4edb-423c-8fa7-d61f33313141","resolution":{"observed_at":"2026-08-06T15:06:47.908155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20704","last_updated":"2025-06-03T16:08:32Z","snapshot_observed_at":"2026-08-07T17:40:59.260406Z","submitted_at":"2025-02-28T04:25:42Z","title":"Fuzzy Speculative Decoding for a Tunable Accuracy-Runtime Tradeoff","version":4},"cited_work":{"arxiv_id":"2502.20704","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.20704","snapshot_observed_at":"2026-08-06T15:06:50.744491Z","title":"Fuzzy Speculative Decoding for a Tunable Accuracy-Runtime Tradeoff","venue":"cs.AI","work_id":"6af5fffa-5c23-46b3-aa4a-5f8967c9fb4f","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.912154Z"},"links":{"cited_paper":"/paper/2502.20704","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:b896a5e36ed3cd2e3c045fd37c389c52e753d71dbac872dec05fd6ac38f00919","observation_id":"3a39018f-15b5-41b3-98c3-800919755608","resolution":{"observed_at":"2026-08-06T15:06:50.749170Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00784","last_updated":"2025-03-02T08:27:48Z","snapshot_observed_at":"2026-08-07T17:36:15.961594Z","submitted_at":"2025-03-02T08:27:48Z","title":"DuoDecoding: Hardware-aware Heterogeneous Speculative Decoding with Dynamic Multi-Sequence Drafting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00784","snapshot_observed_at":"2026-08-06T15:06:47.916285Z","title":"Duodecoding: Hardware-aware heterogeneous speculative decoding with dynamic multi-sequence drafting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.916285Z"},"links":{"cited_paper":"/paper/2503.00784","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:d3a1d313033cd0b1f0cc4915734206448b5bba09eead65223f9ae67b632cf980","observation_id":"228fc0f4-596e-47ef-b711-e1363ff3ce62","resolution":{"observed_at":"2026-08-06T15:06:47.916285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17421","last_updated":"2026-04-08T06:06:59Z","snapshot_observed_at":"2026-08-03T00:39:33.876137Z","submitted_at":"2025-02-24T18:53:31Z","title":"LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17421","snapshot_observed_at":"2026-08-06T15:06:47.920673Z","title":"Longspec: Long-context speculative decoding with efficient drafting and verification","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.920673Z"},"links":{"cited_paper":"/paper/2502.17421","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:42bc34ab00b101369177fa787fb8f0001c60d0d903c642e6402804b60d85a950","observation_id":"7c8c66b4-ac9b-410c-9c57-c71d8d25e634","resolution":{"observed_at":"2026-08-06T15:06:47.920673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.924782Z","title":"Collaboration of large language models and small recommendation models for device-cloud recommendation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.924782Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:9cce490bf469262b7b2a1f5fe5222c4ebcbb1ac6dfec1e931c9c01d009e7acf7","observation_id":"02554bec-0e0f-40e2-806a-3438b12c3541","resolution":{"observed_at":"2026-08-06T15:06:47.924782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.928500Z","title":"Crayon: Customized on-device LLM via instant adapter blending and edge-server hybrid inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.928500Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:b9e2b2b63c3e2db719b7bde1ef163d82a77ceb7dc9637d3f9fc95bc17844482e","observation_id":"c0eb67ef-36c8-4f21-bef5-6efc15a9d170","resolution":{"observed_at":"2026-08-06T15:06:47.928500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.932649Z","title":"Speculative decoding with big little decoder","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.932649Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:1709b33b9c14f31736d10a6c1c1256946bf70aeb019fef1c15f476014e41c614","observation_id":"4aa38c5d-1619-46dd-a8c8-bbbe08456dca","resolution":{"observed_at":"2026-08-06T15:06:47.932649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.936405Z","title":"Cogenesis: A framework collaborating large and small language models for secure context-aware instruction following","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.936405Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:8321c3126e0270eed43d37453fa3cc9e3d0e464bce2b5a2f0dc7db92f11ee437","observation_id":"a278fdd3-a98d-4c48-a7d7-2a961e7f0de5","resolution":{"observed_at":"2026-08-06T15:06:47.936405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.944565Z","title":"Cloud-edge collaborative large model services: Challenges and solutions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.944565Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:2954a248bbdb9f5cf661bb1ced1d1074faf9a56f2455a7c5f47cb3b7c954521a","observation_id":"01175081-3b47-4467-97b4-3550aa770503","resolution":{"observed_at":"2026-08-06T15:06:47.944565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.948753Z","title":"Backpropagation-free multi-modal on-device model adaptation via cloud-device collaboration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.948753Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:b09ed382655d354bd8163580229c467bec8dbe06f54a5a7a058adfc01b4e279f","observation_id":"1b76a8ec-19a5-4235-8784-88635bdcd40f","resolution":{"observed_at":"2026-08-06T15:06:47.948753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-08-10T13:46:16.822794Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-06T15:06:47.952749Z","title":"Reward-guided speculative decoding for efficient llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.952749Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:fd31cddfc8354a2b8a287b1d84c6cf9c9d1cdd47ecba16933fff6b234313edba","observation_id":"b879e10c-fcb3-4518-83f2-40c8eacad096","resolution":{"observed_at":"2026-08-06T15:06:47.952749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.956928Z","title":"Kangaroo: Lossless self-speculative decoding for accelerating llms via double early exiting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.956928Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:56ce706e4ec1f6317bb839a5d2e82552c8bf864c2036be9fb0e978ec9ab89723","observation_id":"f2c4cb9b-af37-4482-b79d-91fddc4e4dba","resolution":{"observed_at":"2026-08-06T15:06:47.956928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12162","last_updated":"2025-05-17T07:09:10Z","snapshot_observed_at":"2026-08-05T21:38:55.998982Z","submitted_at":"2025-01-21T14:15:01Z","title":"AdaServe: Accelerating Multi-SLO LLM Serving with SLO-Customized Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12162","snapshot_observed_at":"2026-08-06T15:06:47.960865Z","title":"Adaserve: Slo-customized llm serving with fine-grained speculative decoding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.960865Z"},"links":{"cited_paper":"/paper/2501.12162","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:484799eb72989bd440a13b4bfded64bff1c1f4e7c0f2d266c62b64b6f220919a","observation_id":"c5ae9cde-a63b-4669-ae61-f28a8dab7742","resolution":{"observed_at":"2026-08-06T15:06:47.960865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09923","last_updated":"2025-06-02T08:10:54Z","snapshot_observed_at":"2026-08-07T16:06:01.120557Z","submitted_at":"2025-04-14T06:32:45Z","title":"Guiding Reasoning in Small Language Models with LLM Assistance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09923","snapshot_observed_at":"2026-08-06T15:06:47.965279Z","title":"Guiding reasoning in small language models with llm assistance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.965279Z"},"links":{"cited_paper":"/paper/2504.09923","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:3cbd44cb05f8b4f1d7f5f491fe3515343724fad10c56a56000466e48cba0e6af","observation_id":"a8a9cfb0-68f6-4bdf-af2b-f88707513c50","resolution":{"observed_at":"2026-08-06T15:06:47.965279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11417","last_updated":"2025-05-24T18:16:01Z","snapshot_observed_at":"2026-08-07T18:13:48.130639Z","submitted_at":"2025-02-17T04:15:45Z","title":"DiSCo: Device-Server Collaborative LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":"2502.11417","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.11417","snapshot_observed_at":"2026-08-06T15:06:50.633139Z","title":"DiSCo: Device-Server Collaborative LLM-Based Text Streaming Services","venue":"cs.LG","work_id":"9d056513-ce1e-4911-bc39-5f8bd0600ac5","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.969205Z"},"links":{"cited_paper":"/paper/2502.11417","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:a6d3fc1852aaecda1b80a0f172653cd09152ea641d51e07f6f79e47126d74b2d","observation_id":"faf29311-9c3d-4e94-b749-2d00670122de","resolution":{"observed_at":"2026-08-06T15:06:50.637879Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.973134Z","title":"Specexec: Massively parallel speculative decoding for interactive llm inference on consumer devices","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.973134Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:fda5b92296be73253d924b8b138247386eade0e92a3a9fea690665839f461326","observation_id":"43227bb7-20d5-4bc1-bcd8-1f5c500a2288","resolution":{"observed_at":"2026-08-06T15:06:47.973134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09367","last_updated":"2025-01-16T08:25:07Z","snapshot_observed_at":"2026-08-07T17:17:40.641951Z","submitted_at":"2025-01-16T08:25:07Z","title":"PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks","version":1},"cited_work":{"arxiv_id":"2501.09367","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09367","snapshot_observed_at":"2026-08-06T15:06:50.614433Z","title":"PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks","venue":"cs.DC","work_id":"0763073c-141f-47f9-a577-12ada064d1d9","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.977017Z"},"links":{"cited_paper":"/paper/2501.09367","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:638474390f629e5c3881f9fff637693a7b61a283fa11ce5ef77f29444ef876b0","observation_id":"15299ace-83f6-4144-92f5-6ac55cade336","resolution":{"observed_at":"2026-08-06T15:06:50.618707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.981324Z","title":"Enhancing on-device llm inference with historical cloud-based llm interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.981324Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:ff2946f0d70ab2d81c75e43724407f6aa7b2900944405e912afdcb504e4836d7","observation_id":"2c5dd40e-0833-4bba-a7bf-064bf0edcdb1","resolution":{"observed_at":"2026-08-06T15:06:47.981324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.985404Z","title":"Velo: A vector database-assisted cloud-edge collaborative llm qos optimization framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.985404Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:0b5535380297dd4d656ed6e3960bb4f9a77471b980879dcd1d5f6f43510f7f7b","observation_id":"5288112b-71d6-42f5-8d52-f5f58a7fecc0","resolution":{"observed_at":"2026-08-06T15:06:47.985404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.990098Z","title":"Fedmkt: Federated mutual knowledge transfer for large and small language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.990098Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:77d5338bd9d5a4847bf7b7d410e93510adc15da56cb534e60cbb7b9be8ef6e22","observation_id":"231b82c3-aaba-43e0-aa98-dc4dfa9f7626","resolution":{"observed_at":"2026-08-06T15:06:47.990098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.994722Z","title":"Federated transfer learning for on-device llms efficient fine tuning optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.994722Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:106d32be92e194d3c4ef4c05fb694e4a9997ea35d7452b70486fbfe06396660e","observation_id":"f3b7c774-f4d6-4099-971a-ed1e2a27f873","resolution":{"observed_at":"2026-08-06T15:06:47.994722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:47.998492Z","title":"Cloud-device collaborative learning for multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:47.998492Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:465a384fc83aa4714e3281e06c3c9a71e3399c79dd7157de30056d63d2f39d95","observation_id":"516181f2-23ef-4801-8793-7b391a7719f3","resolution":{"observed_at":"2026-08-06T15:06:47.998492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.002387Z","title":"Division-of-thoughts: Harnessing hybrid language model synergy for efficient on-device agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.002387Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:f8b632eb04ce82da3b0bc3ad8d7cb5477d21095a316773e7c251f39f788768e9","observation_id":"5ffdc7e0-b1f4-4cd3-9730-245080f57d3b","resolution":{"observed_at":"2026-08-06T15:06:48.002387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14352","last_updated":"2025-03-07T11:16:40Z","snapshot_observed_at":"2026-07-06T16:11:06.578398Z","submitted_at":"2023-08-28T06:56:08Z","title":"EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14352","snapshot_observed_at":"2026-08-06T15:06:48.006502Z","title":"Edgemoe: Fast on-device inference of moe-based large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.006502Z"},"links":{"cited_paper":"/paper/2308.14352","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c7d3d61d8446bd55a6b7dd19b5afea88b7bdbcd1a1b39f109b77ffba3692e3f1","observation_id":"7c498b3c-d2ee-4048-8edc-ecf2cb5ded22","resolution":{"observed_at":"2026-08-06T15:06:48.006502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.010380Z","title":"Resource allocation for stable llm training in mobile edge computing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.010380Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:f0a5bf17cfa8fce2e012e892c807e0133f749086708c5cd717e56d72b2874140","observation_id":"267b1906-1915-48a6-99b8-50211d008776","resolution":{"observed_at":"2026-08-06T15:06:48.010380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.014702Z","title":"Richard Yu, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.014702Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:b438e600354121dec4b45e7034d2e2878f177d1c91d8d0d272196612ad602b6d","observation_id":"4002bb17-a703-443c-bcb9-bbd7726b0828","resolution":{"observed_at":"2026-08-06T15:06:48.014702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.019101Z","title":"Adaptlink: A heterogeneity-aware adaptive framework for distributed mllm inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.019101Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:5ffa57ec49b097236072a5591f8e2cf8f928b38490cbd8190793506e753f25e3","observation_id":"9b51afd1-6105-4ebf-b2f2-89b2871db329","resolution":{"observed_at":"2026-08-06T15:06:48.019101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.024287Z","title":"Hybridrag: Integrating knowledge graphs and vector retrieval augmented generation for efficient information extraction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.024287Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:1095d9f6bdfd640ff68e988064a768807ab89f2b2919b6d3b89410a22a97cfb2","observation_id":"1e71bbb8-2c30-4435-ae81-ecef22a68021","resolution":{"observed_at":"2026-08-06T15:06:48.024287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.032320Z","title":"Edge-cloud collaborative motion planning for autonomous driving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.032320Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:2d859fa4fe8b8871fc239bd04e56e9dbaa0ad17145ce1cfb3ebf9971fb7a8919","observation_id":"7c0797ed-5050-4adf-9cb0-e36e6fbcc00e","resolution":{"observed_at":"2026-08-06T15:06:48.032320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.036107Z","title":"Grey-box prompt optimization and fine-tuning for cloud-edge LLM agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.036107Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:9390882a85f441debcf678ad327a1b022682d10017e5c5ee705e720ede208563","observation_id":"6ba1a355-9957-40af-b36d-2686d4c89f62","resolution":{"observed_at":"2026-08-06T15:06:48.036107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08848","last_updated":"2023-05-15T17:59:01Z","snapshot_observed_at":"2026-08-10T13:07:49.081849Z","submitted_at":"2023-05-15T17:59:01Z","title":"Small Models are Valuable Plug-ins for Large Language Models","version":1},"cited_work":{"arxiv_id":"2305.08848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.08848","snapshot_observed_at":"2026-08-06T15:06:50.578605Z","title":"Small Models are Valuable Plug-ins for Large Language Models","venue":"cs.CL","work_id":"b74b8da1-91d8-46d6-aeb0-a84a15c35514","year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.039819Z"},"links":{"cited_paper":"/paper/2305.08848","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:42a5a1576f12d9fb28110eb35e5473a56a2fce40b0b1491dfcc6f8ccc1cdaf92","observation_id":"c05523b3-74b1-4640-a6ce-1914b3c15716","resolution":{"observed_at":"2026-08-06T15:06:50.582913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.043858Z","title":"Slim: Speculative decoding with hypothesis reduction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.043858Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:9f62cac1a78386cac19b68fc516955a2ec998ccba7e9c059cb4549fcb04246bb","observation_id":"973d24c1-363a-4c1e-bc38-d81a2d6b69e7","resolution":{"observed_at":"2026-08-06T15:06:48.043858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.048193Z","title":"Opt-tree: Speculative decoding with adaptive draft tree structure","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.048193Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:b8a33d1fa580b78a10777b5de14e4b78e7bec6f8db10d21278688e314f373af9","observation_id":"01682603-5ad8-4c78-8896-24e86d66f157","resolution":{"observed_at":"2026-08-06T15:06:48.048193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.056386Z","title":"Speculative decoding via early-exiting for faster llm inference with thompson sampling control mechanism","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.056386Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:f2d26640bcfaa32e31e6557b375c9c7309410b89dd9339f0d3e835e3b5e9c24c","observation_id":"c57eb69f-75ba-4b04-a783-8a705c93c793","resolution":{"observed_at":"2026-08-06T15:06:48.056386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.060481Z","title":"Diffusion-based cloud-edge-device collaborative learning for next poi recommendations","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.060481Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:76684032b45cfb4aa58fcf593427d597ff7ae3939635781c479a79d52b06e734","observation_id":"8277760a-9e1e-44d2-8b1a-1cd5f36a8a69","resolution":{"observed_at":"2026-08-06T15:06:48.060481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.064457Z","title":"An edge-cloud collaboration framework for generative AI service provision with synergetic big cloud model and small edge models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.064457Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:e0aadf5a353878a3be328788e62968f57dda1e723b39463d9a387cd2a12b0606","observation_id":"735b933d-33ef-4182-b33b-3a28b3b002bb","resolution":{"observed_at":"2026-08-06T15:06:48.064457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.068637Z","title":"Enhanced hybrid inference techniques for scalable on-device llm personalization and cloud integration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.068637Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:22c0c820c9b80fa0d0069b912af9a0f9162cd460dc4090a25b1a0175ff2273df","observation_id":"5202ff64-63fc-49e6-a0ec-f40ec67bd070","resolution":{"observed_at":"2026-08-06T15:06:48.068637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.072273Z","title":"Edge-llm: A collaborative framework for large language model serving in edge computing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.072273Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:50b55a7c1218545dc26393bd54f67cf179713029afcc4e057953064e3d0d70ef","observation_id":"998ff21f-2e80-4f76-9392-44ad1656cac4","resolution":{"observed_at":"2026-08-06T15:06:48.072273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.076410Z","title":"Mergenet: Knowledge migration across heterogeneous models, tasks, and modalities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.076410Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:987800297355839a6a9a083d2a2f3a3de867acfe8845635e8f185c24374deae6","observation_id":"3faf622c-f059-4b12-913e-8222802de5c5","resolution":{"observed_at":"2026-08-06T15:06:48.076410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.080515Z","title":"Optimize incompatible parameters through compatibility-aware knowledge integration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.080515Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:acf502521b0a62d93131597a42f34d1caada136e98bfd824882e6df6a611d236","observation_id":"bdcee12f-209a-482f-97b6-0064f98b7bb2","resolution":{"observed_at":"2026-08-06T15:06:48.080515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.085808Z","title":"Forward once for all: Structural parameterized adaptation for efficient cloud-coordinated on-device recommendation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.085808Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:8666466fb5a279e9371f185ecfdec99b0520b348802c29891826f8420f7dff2f","observation_id":"532a5448-74b2-40d1-8bb7-2935af03680f","resolution":{"observed_at":"2026-08-06T15:06:48.085808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.089654Z","title":"Diet: Customized slimming for incompatible networks in sequential recommendation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.089654Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:e1527d18b4acb2b96bcfa69de741076f7a4e76943c987ab59483850a4bcdcecb","observation_id":"c5956217-b19d-4f7d-859c-2a0aae6c393a","resolution":{"observed_at":"2026-08-06T15:06:48.089654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.093911Z","title":"Edge vs cloud: How do we balance cost, latency, and quality for large language models over 5g networks? In Proc","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.093911Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:4a8f6561f0b3379ec186fcc0c469e175b0fa243993fe8a8b8352a63ca2a5a716","observation_id":"78f9552c-1d50-4c12-8f97-2f1f08011068","resolution":{"observed_at":"2026-08-06T15:06:48.093911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.01821","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:50.557126Z","title":"Edge-cloud collaborative computing on distributed intelligence and model optimization: A survey","venue":null,"work_id":"d370607e-0dcc-454d-ac70-dfb81a579f95","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.098078Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:f60fa99dd2671427b6d8214def77b4f5215cd72f0cf92bf0bd7d1ace26f3d819","observation_id":"00b4093f-605d-4e5b-b7e2-520fac5cd94a","resolution":{"observed_at":"2026-08-06T15:06:50.563919Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.102430Z","title":"Fedcfa: Alleviating simpson’s paradox in model aggregation with counterfactual federated learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.102430Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:a5b9019a7185096b8c89b6b45c0a606a4024f63fedf769d2570a93906730dcee","observation_id":"1d28b308-8905-43a8-821e-922186694bee","resolution":{"observed_at":"2026-08-06T15:06:48.102430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12408","last_updated":"2024-02-18T11:24:34Z","snapshot_observed_at":"2026-08-10T11:03:20.937782Z","submitted_at":"2024-02-18T11:24:34Z","title":"ModelGPT: Unleashing LLM's Capabilities for Tailored Model Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12408","snapshot_observed_at":"2026-08-06T15:06:48.106623Z","title":"Modelgpt: Unleashing llm’s capabilities for tailored model generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.106623Z"},"links":{"cited_paper":"/paper/2402.12408","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:7e212c772699ab532716dd1076d594467ab9a65b3a3ff4a531130726615a19c8","observation_id":"a612cf60-e4e3-4447-9492-dc0a342bd879","resolution":{"observed_at":"2026-08-06T15:06:48.106623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.110729Z","title":"Intelligent model update strategy for sequential recommendation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.110729Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:8cef80a00cf125fa5c6c288ed1f37ced21ec304c2c36ef6713bc48375f47d53e","observation_id":"91aa0742-cb64-4a5b-adf5-169bc2cf9f6a","resolution":{"observed_at":"2026-08-06T15:06:48.110729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.114940Z","title":"Aug-kd: Anchor-based mixup generation for out-of-domain knowledge distillation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.114940Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:1c7fb50ca434d6c1ba28087c03556a8ed2383c4dbbe14fb96170ebc7c415f680","observation_id":"b5682957-dbc1-41bf-a2df-e77978b16b0c","resolution":{"observed_at":"2026-08-06T15:06:48.114940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.118957Z","title":"Llmco4mr: Llms-aided neural combinatorial optimization for ancient manuscript restoration from fragments with case studies on dunhuang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.118957Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:cf0b700bab9183d7cee41d088bcbff7556a332d367d2147a825ec9ae0d07b0de","observation_id":"b9804d9f-88f3-47e8-b162-5b3432177e6d","resolution":{"observed_at":"2026-08-06T15:06:48.118957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.123135Z","title":"Mpod123: One image to 3d content generation using mask-enhanced progressive outline-to-detail optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.123135Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:5806b823fc31012763db40e763417042d53697a8920031eb1de8bd372e072b3f","observation_id":"66f99b33-4f42-4b7e-941a-8b773e681444","resolution":{"observed_at":"2026-08-06T15:06:48.123135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11707","last_updated":"2026-04-23T04:42:47Z","snapshot_observed_at":"2026-07-06T19:52:03.121993Z","submitted_at":"2024-11-18T16:34:58Z","title":"Federated Co-tuning Framework for Large and Small Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11707","snapshot_observed_at":"2026-08-06T15:06:48.127431Z","title":"Fedcollm: A parameter-efficient federated co-tuning framework for large and small language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.127431Z"},"links":{"cited_paper":"/paper/2411.11707","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:27db237ff077e2b2fd27d439a3d6e893fff6f0b5d049ac4144929355f6342187","observation_id":"fca98122-c0fe-4b9d-9f03-70aaa2c82326","resolution":{"observed_at":"2026-08-06T15:06:48.127431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21716","last_updated":"2025-04-30T15:00:20Z","snapshot_observed_at":"2026-08-07T15:57:53.851099Z","submitted_at":"2025-04-30T15:00:20Z","title":"LLM-Empowered Embodied Agent for Memory-Augmented Task Planning in Household Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21716","snapshot_observed_at":"2026-08-06T15:06:48.131727Z","title":"Llm-empowered embodied agent for memory-augmented task planning in household robotics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.131727Z"},"links":{"cited_paper":"/paper/2504.21716","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:832f11727ee185dd0fc343b0fb949a8501d33eac518d42945c1c172e4d5f8072","observation_id":"e70067a4-1f7c-4981-bf10-67ef1cf6ac12","resolution":{"observed_at":"2026-08-06T15:06:48.131727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21868","last_updated":"2024-12-20T12:22:37Z","snapshot_observed_at":"2026-08-03T04:33:55.812449Z","submitted_at":"2024-10-29T09:02:37Z","title":"Improving In-Context Learning with Small Language Model Ensembles","version":2},"cited_work":{"arxiv_id":"2410.21868","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.21868","snapshot_observed_at":"2026-08-06T15:06:50.417050Z","title":"Improving In-Context Learning with Small Language Model Ensembles","venue":"cs.CL","work_id":"5c963980-39f7-454c-b4a9-6ff1745effd1","year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.140193Z"},"links":{"cited_paper":"/paper/2410.21868","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:9ad6624274e7e8c27992f15e64a3291e46b0eb19a4846cd1b3c9d483d4901188","observation_id":"9ebfdd1f-29a7-4446-a1c6-195a013ea77b","resolution":{"observed_at":"2026-08-06T15:06:50.421226Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04915","last_updated":"2025-04-07T10:52:22Z","snapshot_observed_at":"2026-08-07T16:08:02.110583Z","submitted_at":"2025-04-07T10:52:22Z","title":"Collab-RAG: Boosting Retrieval-Augmented Generation for Complex Question Answering via White-Box and Black-Box LLM Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04915","snapshot_observed_at":"2026-08-06T15:06:48.144387Z","title":"Collab-rag: Boosting retrieval-augmented generation for complex question answering via white-box and black-box llm collaboration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.144387Z"},"links":{"cited_paper":"/paper/2504.04915","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:2d75aa06b000f409afed92880d8fc7578903307e0892e84527c4426e2293ee4e","observation_id":"9e19f02d-c820-4c75-83cc-21e77a22bd66","resolution":{"observed_at":"2026-08-06T15:06:48.144387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12295","last_updated":"2024-10-23T15:23:00Z","snapshot_observed_at":"2026-08-07T22:15:09.000711Z","submitted_at":"2024-06-18T05:59:28Z","title":"Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding","version":2},"cited_work":{"arxiv_id":"2406.12295","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.12295","snapshot_observed_at":"2026-08-06T15:06:50.694291Z","title":"Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding","venue":"cs.CL","work_id":"45aa5cba-dc18-4a17-8f78-7ac0097624e4","year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.148677Z"},"links":{"cited_paper":"/paper/2406.12295","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:82c6b093911ced89ed1bfd85fab096966d61a6205736305c5ac3debf95e7fd07","observation_id":"c82de8fd-04d0-4a80-b273-620cbdad2c48","resolution":{"observed_at":"2026-08-06T15:06:50.698739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.152787Z","title":"Knowledge-decoupled synergetic learning: An MLLM based collaborative approach to few-shot multimodal dialogue intention recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.152787Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c908d20e8e632809f7c7c999eb936386b573a1399e0b2a13db6399be5cce039f","observation_id":"4c5f2ceb-8ab9-4b8f-8b34-b675e4cd7742","resolution":{"observed_at":"2026-08-06T15:06:48.152787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04428","last_updated":"2025-02-06T18:59:11Z","snapshot_observed_at":"2026-08-09T14:19:04.137868Z","submitted_at":"2025-02-06T18:59:11Z","title":"Confident or Seek Stronger: Exploring Uncertainty-Based On-device LLM Routing From Benchmarking to Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04428","snapshot_observed_at":"2026-08-06T15:06:48.156908Z","title":"Confident or seek stronger: Exploring uncertainty-based on-device llm routing from benchmarking to generalization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.156908Z"},"links":{"cited_paper":"/paper/2502.04428","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:7729ca054c3d7fc6559fac571b7c8e6890a30733a54eaf48e164de60b2c882eb","observation_id":"e16f40c1-1915-40bf-a9e3-ffc0c2c0c6b0","resolution":{"observed_at":"2026-08-06T15:06:48.156908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05842","last_updated":"2023-12-10T09:52:32Z","snapshot_observed_at":"2026-07-06T16:59:23.470071Z","submitted_at":"2023-12-10T09:52:32Z","title":"Mutual Enhancement of Large and Small Language Models with Cross-Silo Knowledge Transfer","version":1},"cited_work":{"arxiv_id":"2312.05842","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.05842","snapshot_observed_at":"2026-08-06T15:06:50.369468Z","title":"Mutual Enhancement of Large and Small Language Models with Cross-Silo Knowledge Transfer","venue":"cs.AI","work_id":"095b5d56-038e-4371-94b2-67dc4dd76c65","year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.161051Z"},"links":{"cited_paper":"/paper/2312.05842","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c83bf371e649b9009b21d680f69ff2984b75ff6d805c1182bf448c540af25a11","observation_id":"120c020f-5b90-445c-9473-495c93c985f6","resolution":{"observed_at":"2026-08-06T15:06:50.374357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.164940Z","title":"Modular pluralism: Pluralistic alignment via multi-llm collaboration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.164940Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:388472b72603d1d9e5bbeb9254a9e967c07310a4dbd05d214c02798e049f41f1","observation_id":"7807077b-69ab-4ed9-9e7e-068b02a047dd","resolution":{"observed_at":"2026-08-06T15:06:48.164940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.09854","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:50.348915Z","title":"Efficient multitask learning in small language models through upside-down reinforcement learning","venue":null,"work_id":"1001966b-ab80-4c7c-93ed-f4e3877b3fe6","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.169136Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:7e2acf849e0b0c9453f41763b00c5c56b39ad71534a6b70033d6fee882b59437","observation_id":"b0f666b6-12ae-4ed1-a579-a727e3dabaa6","resolution":{"observed_at":"2026-08-06T15:06:50.355434Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17421","last_updated":"2026-06-28T12:07:24Z","snapshot_observed_at":"2026-08-08T01:06:38.899394Z","submitted_at":"2025-04-24T10:24:35Z","title":"Towards Harnessing the Collaborative Power of Large and Small Models for Domain Tasks","version":2},"cited_work":{"arxiv_id":"2504.17421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.17421","snapshot_observed_at":"2026-08-06T15:06:50.262608Z","title":"Towards Harnessing the Collaborative Power of Large and Small Models for Domain Tasks","venue":"cs.LG","work_id":"b9db4856-266c-439e-8e5e-5f82056bbce5","year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.172897Z"},"links":{"cited_paper":"/paper/2504.17421","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:8056ae22efdfc0f69791f1258c77178e7f0982536eeb7b68d226a4973b0feffd","observation_id":"c35419c0-6f1e-4660-8682-238d0f362c13","resolution":{"observed_at":"2026-08-06T15:06:50.267056Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.176947Z","title":"Slmrec: Distilling large language models into small for sequential recommendation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.176947Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:369efc07b3d34f39f0e064bc4c7b0eb2ad7f43e72720d7c368f4b023dc159861","observation_id":"644cd732-8050-4301-af46-c70c9874e7bb","resolution":{"observed_at":"2026-08-06T15:06:48.176947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.181066Z","title":"Automix: Automatically mixing language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.181066Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:1cce9add5b2b262a5428dc71fed74310dd724bc86684eb005188d226c75f0d90","observation_id":"738df18b-4af8-466e-97ec-d10e5f91d036","resolution":{"observed_at":"2026-08-06T15:06:48.181066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.185117Z","title":"Weak-to-strong generalization: Eliciting strong capabilities with weak supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.185117Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:234e0e3fb7b2cf2593f0e911a50c5418edd0fed128fdd3c244d3a2dea8c08318","observation_id":"36850940-196f-4620-bde8-bdb722f2b83a","resolution":{"observed_at":"2026-08-06T15:06:48.185117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.188889Z","title":"Routerdc: Query-based router by dual contrastive learning for assembling large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.188889Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:375115cb7709d7a0cb466bbde406b43dfd858bcde1feca1c94211b123dd5aa21","observation_id":"c6635a11-6850-4d36-a47d-bd76c5e9e1c5","resolution":{"observed_at":"2026-08-06T15:06:48.188889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.192463Z","title":"Agentverse: Facilitating multi-agent collaboration and exploring emergent behaviors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.192463Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:c5085b1a457c47e0b9207dff05194db0e15d0b34ae2c858cb768ea5c614ba392","observation_id":"782e8963-cbdd-438c-bccc-6072e9c26cdb","resolution":{"observed_at":"2026-08-06T15:06:48.192463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.196116Z","title":"Heterogeneous lora for federated fine-tuning of on-device foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.196116Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:74c7393b8bbb980ec147a7b4ea6bd45b3fb5f39d1d466dd56ba72572856ecf83","observation_id":"5051c3c2-39c8-41b2-8f68-5fad282e6548","resolution":{"observed_at":"2026-08-06T15:06:48.196116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.200150Z","title":"Hybrid llm: Cost-efficient and quality-aware query routing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.200150Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:175afa4187476995af3396e708096bce710ca28d4efcc5220bd9474396bba707","observation_id":"dd95f176-65bc-4cd3-95dd-db3a870e3b8e","resolution":{"observed_at":"2026-08-06T15:06:48.200150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.203867Z","title":"Data shunt: Collaboration of small and large models for lower costs and better performance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.203867Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:507cd46ba26f84fc2c124f622ea6dbc98bbfb49b749115c29c7f863f67f5b6dd","observation_id":"1413d994-fff7-437b-8604-594977cff927","resolution":{"observed_at":"2026-08-06T15:06:48.203867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.207691Z","title":"Distilling step-by-step! outperforming larger language models with less training data and smaller model sizes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.207691Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:abf50370fa0c1b59c18e068a9c880f3412c09172e887f19bef7cd194958e79e6","observation_id":"54c81c12-6870-4070-acd1-82ff73172ad6","resolution":{"observed_at":"2026-08-06T15:06:48.207691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.212086Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.212086Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:59553b78c0995911a10a6ea3b860f730328d4c27a0fde9d75b4577c66fa2e101","observation_id":"78db0748-3486-478f-8e6d-7c3f05bc38fe","resolution":{"observed_at":"2026-08-06T15:06:48.212086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.216030Z","title":"Ddk: Distilling domain knowledge for efficient large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.216030Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:94e6b0ef99f59c7c9ae393e2291a6926b9d769d5bbb3f81bfb78e35f32475af2","observation_id":"83de7eae-ebd0-45ee-a5da-41299bffe684","resolution":{"observed_at":"2026-08-06T15:06:48.216030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15505","last_updated":"2024-02-23T18:56:11Z","snapshot_observed_at":"2026-08-08T14:55:09.613737Z","submitted_at":"2024-02-23T18:56:11Z","title":"Co-Supervised Learning: Improving Weak-to-Strong Generalization with Hierarchical Mixture of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15505","snapshot_observed_at":"2026-08-06T15:06:48.219696Z","title":"Co-supervised learning: Improving weak-to-strong generalization with hierarchical mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.219696Z"},"links":{"cited_paper":"/paper/2402.15505","citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:bee9fefc18ab72546427d20086fb87e590bdce839fc63b9283d262976007b8a9","observation_id":"4790f1c0-6132-40a0-9fb8-2ec552bf9b75","resolution":{"observed_at":"2026-08-06T15:06:48.219696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.223830Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.223830Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:842ab91201800f6b54a48c0909c4489d2ce4af75cd1cb4b571150d6e7feabd3d","observation_id":"8de31c04-962b-4f74-b597-d86c19b2e181","resolution":{"observed_at":"2026-08-06T15:06:48.223830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.227703Z","title":"Duet: A tuning-free device-cloud collaborative parameters generation framework for efficient device model generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.227703Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:f08195d4265ffb7dd92b59f917584345d0a2696fdef843fefaf1d99cd4386176","observation_id":"fb76b218-69eb-49e7-8e7d-7b12bba5b73d","resolution":{"observed_at":"2026-08-06T15:06:48.227703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:06:48.231805Z","title":"An emulator for fine-tuning large language models using small language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-06T15:06:48.231805Z"},"links":{"citing_paper":"/paper/2507.16731"},"observation_digest":"sha256:e588231f26e701ff7c638d261658811b616165a1e1c83271297e219e35b552a8","observation_id":"15f536a6-b30d-46ab-a9cd-887b819afc65","resolution":{"observed_at":"2026-08-06T15:06:48.231805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":90,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":288},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 288 outbound references and 9 inbound Pith citation observations for arXiv:2507.16731."}