{"as_of":"2026-08-17T16:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f0fc676d9aab764d417fa3985e980a1b098ce456b870a9e7f0efb972eb59f794","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:55:45.235032Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:53:26.821910Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T17:05:02.945302Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-16T05:53:26.821910Z","title":"Uncertainty-aware hybrid inference with on-devic e small and remote large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19591","last_updated":"2025-04-28T08:53:39Z","snapshot_observed_at":"2026-08-16T12:42:27.593154Z","submitted_at":"2025-04-28T08:53:39Z","title":"Semantic Packet Aggregation for Token Communication via Genetic Beam Search","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:53:26.821910Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2504.19591"},"observation_digest":"sha256:df31ff9cb00ff293de107e84b1ec5d89cabcfe9202344db0cdbfbc54d1dc5559","observation_id":"ac5c0747-3d9d-4a73-b154-a2819754f540","resolution":{"observed_at":"2026-08-16T05:53:26.821910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-15T21:43:56.705132Z","title":"Unc ertainty- aware hybrid inference with on-Device small and remote larg e language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09214","last_updated":"2025-05-14T08:18:55Z","snapshot_observed_at":"2026-08-16T12:42:32.405795Z","submitted_at":"2025-05-14T08:18:55Z","title":"The Larger the Merrier? Efficient Large AI Model Inference in Wireless Edge Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:43:56.705132Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2505.09214"},"observation_digest":"sha256:8a5e18a8fd7f82c8e15a77d86e7e0b2af6144778380020f61848ee16ea82bd3a","observation_id":"3619cabc-515e-4763-a9a8-7821d0ffc3e9","resolution":{"observed_at":"2026-08-15T21:43:56.705132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-15T20:55:06.669092Z","title":"Uncertainty-aware hybrid inference with on-device small and remote large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11788","last_updated":"2026-05-25T03:16:45Z","snapshot_observed_at":"2026-08-16T12:41:57.997276Z","submitted_at":"2025-05-17T02:10:34Z","title":"Communication-Efficient Hybrid Language Model via Uncertainty-Aware Opportunistic and Compressed Transmission","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:55:06.669092Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2505.11788"},"observation_digest":"sha256:8b01a6183d201b1754e64ad75391aace44ec5e77ec41492194a7eec7d3e7e533","observation_id":"bacd9d4a-a979-40c7-bde9-06f33b506bd8","resolution":{"observed_at":"2026-08-15T20:55:06.669092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-07T05:59:02.769207Z","title":"Q., and Kim, S.-L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06526","last_updated":"2025-06-06T20:42:39Z","snapshot_observed_at":"2026-08-16T12:42:30.331634Z","submitted_at":"2025-06-06T20:42:39Z","title":"Prompting Wireless Networks: Reinforced In-Context Learning for Power Control","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:59:02.769207Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2506.06526"},"observation_digest":"sha256:747a516c682e971b794747d5547a3c34753ef592edf8873cdc8e67aeba43a818","observation_id":"ef0da03f-33c7-4127-b10c-6dd7f4416723","resolution":{"observed_at":"2026-08-07T05:59:02.769207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-06T23:13:02.245722Z","title":"Uncertainty-aware hybrid inference with on-devic e small and remote large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19451","last_updated":"2025-06-24T09:25:44Z","snapshot_observed_at":"2026-08-17T07:35:51.832811Z","submitted_at":"2025-06-24T09:25:44Z","title":"Low-Complexity Semantic Packet Aggregation for Token Communication via Lookahead Search","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:13:02.245722Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2506.19451"},"observation_digest":"sha256:4f3280d440155f740e772187c75c7194ad44fa2c668c5cd4dd53ec7d5f63ef81","observation_id":"18aed4b0-f397-4acc-9500-50d23ce2a4f0","resolution":{"observed_at":"2026-08-06T23:13:02.245722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"cited_work":{"arxiv_id":"2412.12687","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.12687","snapshot_observed_at":"2026-08-06T17:05:02.945302Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","venue":"cs.LG","work_id":"ad547c41-a324-4f0b-9352-1ec4e520020c","year":2024},"citing_paper":{"arxiv_id":"2507.12000","last_updated":"2025-07-17T02:34:42Z","snapshot_observed_at":"2026-08-13T16:23:11.053861Z","submitted_at":"2025-07-16T07:55:06Z","title":"DSSD: Efficient Edge-Device LLM Deployment and Collaborative Inference via Distributed Split Speculative Decoding","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:05:02.637601Z"},"links":{"cited_paper":"/paper/2412.12687","citing_paper":"/paper/2507.12000"},"observation_digest":"sha256:fc29384c28485e90833edecf5c1474177b57d45d72a20d84ebcbc29810141ded","observation_id":"87813549-5074-4d4a-9217-32a086a73519","resolution":{"observed_at":"2026-08-06T17:05:03.040669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12687/citation-record","integrity":"/paper/2412.12687/integrity","json":"/paper/2412.12687/citation-record.json","paper":"/paper/2412.12687"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T13:55:45.163262Z","title":"Training compute-optimal large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.163262Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:3446eb9804d1a552cf60374e2e1c2a241c2712b1dbbba7bd70ab23b2159b6347","observation_id":"8982ab12-7561-4c0e-b348-5c320e3df8a3","resolution":{"observed_at":"2026-08-11T13:55:45.163262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.466025Z","title":"Harnessing the power of llms in practice: A survey on chatgpt and beyond,","venue":null,"work_id":"eed124d3-d6a0-4b39-8b8d-f8f5d5c6dd61","year":2024},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.169883Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:9cb81e557f06b885013f418fb013a04a9ff48dbea2ea8e63d3218da1e69fe92f","observation_id":"dbcb050e-499a-4e27-896e-3bdf9460e414","resolution":{"observed_at":"2026-08-11T13:55:45.471463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.449577Z","title":"Llm-pruner: On the structural pruning of large language models,","venue":null,"work_id":"7de4651c-59ea-42c0-8fc4-271736c3132e","year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.174399Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:b869236c83baba46c17ba5556331607254848733aac249729336c246745ae16a","observation_id":"7f57e927-76ce-4e92-afd8-0cfaa7c3dae9","resolution":{"observed_at":"2026-08-11T13:55:45.454338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08659","last_updated":"2023-11-28T16:06:59Z","snapshot_observed_at":"2026-08-16T21:20:07.431044Z","submitted_at":"2023-10-12T18:34:08Z","title":"LoftQ: LoRA-Fine-Tuning-Aware Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08659","snapshot_observed_at":"2026-08-11T13:55:45.180184Z","title":"Loftq: Lora-fine-tuning-aware quantization for large lan- guage models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.180184Z"},"links":{"cited_paper":"/paper/2310.08659","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:4deda6a0cb6f044b69504eca8359e9a49724349581fa9dc843e042f62cfa469e","observation_id":"09eb085e-17ca-4abc-ac74-87654ef31a8f","resolution":{"observed_at":"2026-08-11T13:55:45.180184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08461","last_updated":"2024-03-31T03:06:51Z","snapshot_observed_at":"2026-08-16T14:52:38.095793Z","submitted_at":"2023-10-12T16:21:04Z","title":"DistillSpec: Improving Speculative Decoding via Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08461","snapshot_observed_at":"2026-08-11T13:55:45.185076Z","title":"Distillspec: Improving speculative decoding via knowl- edge distillation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.185076Z"},"links":{"cited_paper":"/paper/2310.08461","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:cbc5808dc498b71adb4278215850a6b3ecb85702e1af7a4e0c57a36655959311","observation_id":"dcd60f6c-a7d5-47c5-80ca-f0d8753e08a4","resolution":{"observed_at":"2026-08-11T13:55:45.185076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.435263Z","title":"Hybrid slm and llm for edge-cloud collaborative inference,","venue":null,"work_id":"af7c903b-7ed3-4847-b74d-82395bb2fec3","year":2024},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.192117Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:93cf19699b76fa0f4df11d18dc3f8ffedf43567223c2a5a85a3f5d3f2dd420ba","observation_id":"ee27de9a-7b8e-40d6-a3a6-8b1cb174733d","resolution":{"observed_at":"2026-08-11T13:55:45.439985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.420056Z","title":"Fast inference from transform- ers via speculative decoding,","venue":null,"work_id":"ef896883-342c-4be7-be22-65b03ff7d62f","year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.197135Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:cf4e047c35d9e1a97c0b6840060629f33fd3dba0c6b1075895e69de2a643f882","observation_id":"c396383c-43c3-4c48-ade8-bc941dcefdbf","resolution":{"observed_at":"2026-08-11T13:55:45.425572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.202129Z","title":"Understanding the metropolis-hastings algorithm,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.202129Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:4a2a14e40f50064655a9e7cfaa7777a4bfb4a28000e2caaec37cb07557dd60e6","observation_id":"f219e540-4030-46ea-afaa-e526d3f5f1f6","resolution":{"observed_at":"2026-08-11T13:55:45.202129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.206967Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.206967Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:aaaabd5bb210c91b9e99f9b4c10cf9bf002aa81f4ef5ac9f540749730a0320a1","observation_id":"e9f3a79e-7c5c-460c-957d-995813ec170a","resolution":{"observed_at":"2026-08-11T13:55:45.206967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10236","last_updated":"2025-01-05T06:15:04Z","snapshot_observed_at":"2026-08-16T15:15:56.313771Z","submitted_at":"2023-07-16T08:28:04Z","title":"Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10236","snapshot_observed_at":"2026-08-11T13:55:45.211650Z","title":"Look before you leap: An exploratory study of uncertainty measurement for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.211650Z"},"links":{"cited_paper":"/paper/2307.10236","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:dec04f4bd938ede28f6e25a70b95be386c225ed60b1be5b54b5dc12d312cb193","observation_id":"3f6f6ccc-3a78-4c15-a236-945adbca0013","resolution":{"observed_at":"2026-08-11T13:55:45.211650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02509","last_updated":"2024-03-04T21:55:22Z","snapshot_observed_at":"2026-08-16T14:12:52.339586Z","submitted_at":"2024-03-04T21:55:22Z","title":"SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02509","snapshot_observed_at":"2026-08-11T13:55:45.217207Z","title":"Spuq: Perturbation-based uncertainty quantification for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.217207Z"},"links":{"cited_paper":"/paper/2403.02509","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:7c22ed2c31f8b32e4d615624c004839cf9bbc7a1b719b1b1e05c95dec95a0ab7","observation_id":"523e6b7f-88e4-4ba8-84b4-3e7d68e4accc","resolution":{"observed_at":"2026-08-11T13:55:45.217207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.222000Z","title":"Wordnet: a lexical database for english,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.222000Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:9c855eb05d701663ca7dc3247657d8a542b408a4ee306ca3d425b6985f07d7c2","observation_id":"69cb4e8e-17d4-4317-947e-13ae09a95eee","resolution":{"observed_at":"2026-08-11T13:55:45.222000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.377048Z","title":"Stanford alpaca: An instruction-following llama model,","venue":null,"work_id":"aa36b3b3-5bb7-4938-b037-9c8e6b690df5","year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.226468Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:805ba2c4c2712b311d4cc945d1afd2ec62bcfe590dcf20c4da5879d910754efb","observation_id":"6ec2920f-1329-4c20-889a-7ab334710ae2","resolution":{"observed_at":"2026-08-11T13:55:45.381778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:55:45.361302Z","title":"The flan collection: Designing data and methods for effective instruction tuning,","venue":null,"work_id":"68ccc6e1-ce23-44df-ad4d-3357fc4a903c","year":2023},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.231224Z"},"links":{"citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:0c1437bec4b8b2d6c988a3e1ce2d9aa39e00560f88c5fa3965882e43dd7e201d","observation_id":"c08093f0-8d7e-4a69-899d-37120135de1a","resolution":{"observed_at":"2026-08-11T13:55:45.367543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11175","last_updated":"2018-04-12T17:03:44Z","snapshot_observed_at":"2026-08-14T19:31:00.623029Z","submitted_at":"2018-03-29T17:43:03Z","title":"Universal Sentence Encoder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11175","snapshot_observed_at":"2026-08-11T13:55:45.235032Z","title":"Universal sentence encoder,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:55:45.235032Z"},"links":{"cited_paper":"/paper/1803.11175","citing_paper":"/paper/2412.12687"},"observation_digest":"sha256:8f378e01b6be5a54fa041a973f6380a1522397034c31598e3f5d999b2b55c744","observation_id":"adda9605-51ae-48ae-b5d0-868fb525a047","resolution":{"observed_at":"2026-08-11T13:55:45.235032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12687","last_updated":"2025-03-18T10:50:58Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:41:48.781795Z","submitted_at":"2024-12-17T09:08:18Z","title":"Uncertainty-Aware Hybrid Inference with On-Device Small and Remote Large Language Models"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 6 inbound Pith citation observations for arXiv:2412.12687."}