{"as_of":"2026-08-11T07:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3e78285c11306607d88eef954f11cc8a462d2fc0c85914043d5eda0b165e087","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:52.273544Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16502/citation-record","integrity":"/paper/2505.16502/integrity","json":"/paper/2505.16502/citation-record.json","paper":"/paper/2505.16502"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.242723Z","title":"A survey on end- edge-cloud orchestrated network computing paradigms: Transparent computing, mobile edge computing, fog computing, and cloudlet,","venue":null,"work_id":"7954b50c-7288-47a1-ae97-24336e0ac175","year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.076398Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8c9275fe4136be04087fdce4cf4572c7d44f02fa917c6c01a38eb21928b19e7e","observation_id":"aa7fe6c9-320f-4388-9a05-fe9051103818","resolution":{"observed_at":"2026-08-07T15:03:59.295812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.142503Z","title":"Dis- tributed artificial intelligence empowered by end-edge-cloud computing: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.142503Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e82ad304421d1309bf3f89ec0f0b7210a443d7c3bee837a95b43ce93b20535d6","observation_id":"f77921d4-2656-419c-ae18-8088998682bc","resolution":{"observed_at":"2026-08-07T15:03:45.142503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.128868Z","title":"End-edge-cloud collaborative computing for deep learning: A comprehensive survey,","venue":null,"work_id":"5676de8c-1eeb-42f7-a8f3-70ef89a88d8a","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.264096Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:b447182f48fee1b4e060c19688d8f17ca650ed38f8a4083b1f529bcbf631a7b5","observation_id":"3f215ae8-c10f-47f0-923d-c294348d0682","resolution":{"observed_at":"2026-08-07T15:03:59.163826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.329579Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.329579Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:32eab12edb5bf8f6bf56addf6271adf155c35f49bf4f4303d7346e3148e31363","observation_id":"eb72d876-72d2-4dc2-a707-d1dc6bf31405","resolution":{"observed_at":"2026-08-07T15:03:45.329579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.404337Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.404337Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f17e45c11ccad6bd9e564c47e99aeee9be37c231e4b0c2f16dd73e6f67f8c4c3","observation_id":"ab2a75da-8b60-4eeb-9ac5-b1a4cfe143c6","resolution":{"observed_at":"2026-08-07T15:03:45.404337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T15:03:45.458221Z","title":"A comprehensive overview of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.458221Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e4f9210ee461279612d742e2253ff7a034ace53f48f76a86a6118508f57cf4cf","observation_id":"bcfca86d-27ec-48fa-b918-ad18c20ff31c","resolution":{"observed_at":"2026-08-07T15:03:45.458221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.934584Z","title":"Gpt-3.5 turbo: Legacy gpt model for cheaper chat and non-chat tasks,","venue":null,"work_id":"7a316b8b-ed30-44b6-8125-c7acf0982070","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.544841Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:050751599c4b920217db7f7ea308a7b922faf7b13f4ee104c8c9e8f4665011a2","observation_id":"a01ef14f-811c-4325-8f3d-8e9ea054bc51","resolution":{"observed_at":"2026-08-07T15:03:59.006806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.650559Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.650559Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:076987e27b0641fe7e1ea07888dbf21642718e40feaed91238f88cef1a38a33d","observation_id":"25230337-a15e-4a4e-acb9-bca39da67ce4","resolution":{"observed_at":"2026-08-07T15:03:45.650559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:03:45.753416Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.753416Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f15f1e0316635629a747b73c4eb84c0b6d962b9e14a7f1a22f7c9608f83260d4","observation_id":"f7a38dc9-0d01-4778-b9eb-0644d69bbbc3","resolution":{"observed_at":"2026-08-07T15:03:45.753416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.843711Z","title":"Mobilellm: Optimizing sub- billion parameter language models for on-device use cases,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.843711Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ba6a7546250ccc387b9ef17bdc1cfb07665d037a952e49b801460746d2581843","observation_id":"2ed8bc71-5a54-4795-8ad1-fad87f664103","resolution":{"observed_at":"2026-08-07T15:03:45.843711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T15:03:45.923625Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.923625Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:81c201274be25293957c724f0e675ffb80e65439c75e82e9c496c94c5fd8ac38","observation_id":"b2317f5c-7ad2-4377-9116-c5637ac4b1b8","resolution":{"observed_at":"2026-08-07T15:03:45.923625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.008149Z","title":"{ServerlessLLM}:{Low-Latency}serverless inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.008149Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e30cabfa84417e51e904ba12fa95c92576a96bc510756ea5dd114d25e9d9d8a6","observation_id":"d6eb5a5f-1d98-488f-928c-956135fe1f98","resolution":{"observed_at":"2026-08-07T15:03:46.008149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.100507Z","title":"{DistServe}: Disaggregating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.100507Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0a7cdfedc05429bda660be97ccace7090663adf7de9fa708e88d7c09b5876074","observation_id":"1b5dddea-3ba0-4b48-badf-7f62bda68647","resolution":{"observed_at":"2026-08-07T15:03:46.100507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14636","last_updated":"2024-05-23T14:41:22Z","snapshot_observed_at":"2026-08-10T08:07:18.214968Z","submitted_at":"2024-05-23T14:41:22Z","title":"PerLLM: Personalized Inference Scheduling with Edge-Cloud Collaboration for Diverse LLM Services","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14636","snapshot_observed_at":"2026-08-07T15:03:46.208795Z","title":"Perllm: Personalized inference scheduling with edge-cloud collaboration for diverse llm services,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.208795Z"},"links":{"cited_paper":"/paper/2405.14636","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:27d6107adecd34b043346c58b56d3efefe33853c06795ac2a66e4e7c8d46b6a2","observation_id":"73a11d3a-22f3-458f-a75f-e2a7bb9bc1d9","resolution":{"observed_at":"2026-08-07T15:03:46.208795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16739","last_updated":"2025-06-04T07:22:47Z","snapshot_observed_at":"2026-08-03T22:38:00.596602Z","submitted_at":"2023-09-28T06:22:59Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16739","snapshot_observed_at":"2026-08-07T15:03:46.283789Z","title":"Pushing large language models to the 6g edge: Vision, challenges, and opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.283789Z"},"links":{"cited_paper":"/paper/2309.16739","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:27aaec2c39c907eed765eccabf568a5504de3d9ec97850d11a75641f64b1bfd6","observation_id":"da6cac04-25d0-47ac-a936-3ad56c881256","resolution":{"observed_at":"2026-08-07T15:03:46.283789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.763219Z","title":"Efficient inference with model cascades,","venue":null,"work_id":"b4216973-5e7f-4fda-a108-3a035d4cc873","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.377623Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:7dcdefd1ee32518654ceb2a95fcafbf06028319e8f19fa56ee8644cc9bd97001","observation_id":"6766779f-6476-4dfd-865d-f41dc0b30e16","resolution":{"observed_at":"2026-08-07T15:03:58.861224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:03:46.472500Z","title":"Qwen2. 5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.472500Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:878ec73cb8d184e4c53e7541b8c46af8d6957b5019340e180eb81d85fde92fab","observation_id":"fe9a6b1a-9ace-4529-9776-56d122b8a1f2","resolution":{"observed_at":"2026-08-07T15:03:46.472500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.665289Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.665289Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:d8d4056967a0630b61ca7d642bd5fb7036f34794e40a349dc9873b56a5c16057","observation_id":"fb86c9cc-4413-474c-a201-d1c08b9af139","resolution":{"observed_at":"2026-08-07T15:03:46.665289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T15:03:46.801880Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.801880Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:3e3dcd345f12e3179cba54e26bcee2abac63dc1edd8ac1bfd5b324790a921fdd","observation_id":"c4cfdc39-7d1f-4288-9907-06ee40cbe904","resolution":{"observed_at":"2026-08-07T15:03:46.801880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.912356Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.912356Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ba25a91609c5917d6ef70c9aacb8a2261a70efbda6dd073d8c4be59387928666","observation_id":"ea9eb830-3b46-439f-9401-9b178ed6583c","resolution":{"observed_at":"2026-08-07T15:03:46.912356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.026514Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.026514Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:af9e130568bcc82cdaa21e5e414f4760ffb8c588115722affb942a3c7e71e540","observation_id":"58c05c6f-8467-457d-8f09-7d207f627d5f","resolution":{"observed_at":"2026-08-07T15:03:47.026514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.230760Z","title":"Parameter-efficient transfer learning for nlp,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.230760Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:094d1ef8e9f5c55358845311dbac126d6480502b2b419d8593b8fbd9f4fe68a7","observation_id":"e5626681-1294-465b-8b1a-5b59e0c4209d","resolution":{"observed_at":"2026-08-07T15:03:47.230760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.377214Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.377214Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8f3f50d7479959d1388b82d0afac68e63a044c36d990dca254c11596fc3a6a1f","observation_id":"12341310-0a32-45ad-85de-817700fec943","resolution":{"observed_at":"2026-08-07T15:03:47.377214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.505628Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.505628Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:4a15a3f3e889590b3166a01d241dcf5aac77d3ac70a2cecf3504cd28fd4a9e3b","observation_id":"1c220965-1093-49be-b32d-13a34c0f0198","resolution":{"observed_at":"2026-08-07T15:03:47.505628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.601135Z","title":"Dis- tributed artificial intelligence empowered by end-edge-cloud computing: A survey,","venue":null,"work_id":"7bb39076-1073-4511-a001-3bd5cb598e21","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.669111Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:6cf2ed07596fe4ad53f9d6ebd657ce01f54ec4f29951c86f549e26531a878d31","observation_id":"5649af48-5e9d-4231-9b66-fd765b631585","resolution":{"observed_at":"2026-08-07T15:03:58.634111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.499315Z","title":"Hierarchical federated learning with momentum acceleration in multi-tier networks,","venue":null,"work_id":"233482b2-2b41-45d6-a387-859dc315522a","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.806170Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:708d42aec1e0685b1c1acf856f084882d0855534ba130305cccd881724e743ef","observation_id":"8b4bfa50-169f-45f8-b423-e042506f7d05","resolution":{"observed_at":"2026-08-07T15:03:58.548740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00693","last_updated":"2025-01-01T01:11:16Z","snapshot_observed_at":"2026-08-11T05:54:52.990865Z","submitted_at":"2025-01-01T01:11:16Z","title":"Beyond Model Scale Limits: End-Edge-Cloud Federated Learning with Self-Rectified Knowledge Agglomeration","version":1},"cited_work":{"arxiv_id":"2501.00693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00693","snapshot_observed_at":"2026-08-07T15:03:52.666012Z","title":"Beyond Model Scale Limits: End-Edge-Cloud Federated Learning with Self-Rectified Knowledge Agglomeration","venue":"cs.DC","work_id":"704f0f7f-d44b-4d2c-be48-0a824d356c87","year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.922256Z"},"links":{"cited_paper":"/paper/2501.00693","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:07a828360e8d59ddd8ede1b6be9aaa15796ce406ea083e08890e4398065414de","observation_id":"24ca8780-8122-4a60-a889-70b24090a5d2","resolution":{"observed_at":"2026-08-07T15:03:52.743891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.320399Z","title":"Edge computing: Vision and challenges,","venue":null,"work_id":"dfc99069-2442-4c4f-8cf2-d6cf57124fc3","year":2016},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.046639Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:52c0aec66a3e85135862496d7d546864ed8b1d56b2164d71a57e47e3aa2534c1","observation_id":"7498f6e8-89f6-47e5-ab55-939469e442b5","resolution":{"observed_at":"2026-08-07T15:03:58.405051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.149573Z","title":"Agglomerative federated learning: Empowering larger model training via end-edge-cloud collaboration,","venue":null,"work_id":"2cec9626-7b44-4fb5-9e24-d754d7fdf78c","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.155815Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:48a560d5d61d6fd6ed875c563dcfa57414703d33024a92f92ad91a8858c190b3","observation_id":"d79cd0c6-d67b-4ac0-b065-fef664d5da20","resolution":{"observed_at":"2026-08-07T15:03:58.225478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.015718Z","title":"A survey on task offloading in multi-access edge computing,","venue":null,"work_id":"4202cb75-93c9-44cb-821e-103f6c13ad05","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.310107Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:41908280dc2477ce475f2ea0a2ff62e4a659d29f51a79814541c00491dfb7875","observation_id":"d5acd8c2-7037-4179-90c3-8c00e1c28528","resolution":{"observed_at":"2026-08-07T15:03:58.079500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.902900Z","title":"Task offloading in edge and cloud computing: A survey on mathe- matical, artificial intelligence and control theory solutions,","venue":null,"work_id":"5675eb36-9404-4161-985b-82b96d2bf7c0","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.484060Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:7980b43eca1090ed23ec80649291a6b43b604eb77321991c44eb0942c83bdf5b","observation_id":"f3e0427c-0e76-44b0-a227-a11d7b708806","resolution":{"observed_at":"2026-08-07T15:03:57.957436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:48.628574Z","title":"Task offloading strategies for mobile edge computing: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.628574Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ad01b5630fef162601fcd97520568a009b6ff032893706c3a7eeaceb05bda101","observation_id":"7c44ead7-ea88-496d-9950-d349e5850307","resolution":{"observed_at":"2026-08-07T15:03:48.628574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04972","last_updated":"2021-06-09T10:37:29Z","snapshot_observed_at":"2026-07-06T11:17:31.238458Z","submitted_at":"2021-06-09T10:37:29Z","title":"Understanding Softmax Confidence and Uncertainty","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04972","snapshot_observed_at":"2026-08-07T15:03:48.772333Z","title":"Understanding softmax confidence and uncertainty,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.772333Z"},"links":{"cited_paper":"/paper/2106.04972","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:80e5829b3b68a2775deb560bcf1420e12c9bc3b87f610274bc9c715a2d8e115f","observation_id":"e028b19b-8c6a-47f9-ab94-6996b5cbd4db","resolution":{"observed_at":"2026-08-07T15:03:48.772333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.714851Z","title":"Learning word vectors for sentiment analysis,","venue":null,"work_id":"b9bfcd4a-826b-40f9-9efa-fbefdaa02c9a","year":2011},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.886489Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e1a0e78a349e7d7bea337f5092b1e4145da2348b6973580f341d7d2f0b5d9d9b","observation_id":"50ff5842-17b7-4718-ad52-89b3239ddd89","resolution":{"observed_at":"2026-08-07T15:03:57.794122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.045269Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.045269Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0b4233626dfaed32516d971a19e50d7331a89eb6b5be4b532184258e0f1dc3d4","observation_id":"a41db557-4579-4c35-b173-7ca3378f78da","resolution":{"observed_at":"2026-08-07T15:03:49.045269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0506075","last_updated":"2005-06-17T20:10:43Z","snapshot_observed_at":"2026-08-05T01:41:21.910243Z","submitted_at":"2005-06-17T20:10:43Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cs/0506075","snapshot_observed_at":"2026-08-07T15:03:49.182037Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.182037Z"},"links":{"cited_paper":"/paper/cs/0506075","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:5afe1a9a8125c711dc674eb010525d06f12dd80cc3f98cc8e86fb69a7cb22f6d","observation_id":"d086e3e3-30b7-409b-9f25-e592378d824b","resolution":{"observed_at":"2026-08-07T15:03:49.182037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.300335Z","title":"Character-level convolutional net- works for text classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.300335Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:bc4453c72a2113f74388a728171502c6086de7d25d41a721ee9cf1e195d9342b","observation_id":"2d962a16-7adf-464c-8e15-e38b2f908de3","resolution":{"observed_at":"2026-08-07T15:03:49.300335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.555013Z","title":"Findings of the 2016 conference on machine translation (wmt16),","venue":null,"work_id":"2321ce0a-4a5c-4d40-8be9-1b113a4f5804","year":2016},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.392173Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:3aa43ca6ea7ca3fb607b3b9c8711a8d12b707d669a3afdfa72d4b797d235ce3b","observation_id":"644c1433-3904-42d3-80d2-597d9476ef17","resolution":{"observed_at":"2026-08-07T15:03:57.639659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.370764Z","title":"Findings of the 2019 conference on machine translation (wmt19)","venue":null,"work_id":"f412b73e-230c-4445-8c33-d15b6d116b28","year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.470211Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0dca06f20362ddadac9e582dd99ecfaf8ff4754011f544a650af2a111bfe4806","observation_id":"c810788b-214c-4344-a706-30a0963994ed","resolution":{"observed_at":"2026-08-07T15:03:57.457477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.268292Z","title":"Parallel data, tools and interfaces in opus","venue":null,"work_id":"720d8ab5-010d-40bc-99b4-f7ffca79576e","year":null},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.550713Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:024f431715681c9b8dce0a89dc68a25d48e4d23db6c9b25a5156ef9c55ea81bb","observation_id":"76359dcb-60c3-476c-9878-d0486ec53186","resolution":{"observed_at":"2026-08-07T15:03:57.330586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T15:03:49.730829Z","title":"Distilbert, a dis- tilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.730829Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0bcaf58a5cabccd835afcef2137fab996c066c239ebfab8990d203b05444b0f4","observation_id":"b17ff19c-a4e9-4a96-924d-b442082e52eb","resolution":{"observed_at":"2026-08-07T15:03:49.730829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.841142Z","title":"azizbarank/distilroberta-base-sst2-distilled,","venue":null,"work_id":"3e2d482c-3947-4f05-956b-bb6322d9bd66","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.812973Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:b62d4b9f0a5cbb18f3080c846aec6b8c277ca3b5ba5aafbbbddc5f5c10d67933","observation_id":"abfb892a-ec6a-4c3c-a302-cd7c306b8f78","resolution":{"observed_at":"2026-08-07T15:03:57.009408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.633610Z","title":"textattack/roberta-base-sst-2,","venue":null,"work_id":"eb545e99-4401-4e23-9f67-7ce3aa6b1754","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.895699Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:47fd829892cdd4af0c6f96149412beedb1449a4063c1108906440aaac166b8f1","observation_id":"faa6c4e7-a457-4519-9e99-ed4aa3f18813","resolution":{"observed_at":"2026-08-07T15:03:56.742490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.414880Z","title":"howey/roberta-large-sst2,","venue":null,"work_id":"943d19fb-7962-4a84-b303-3d3c4dd718df","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.977530Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ef528d69b03e4026e9d0c7aca7762a1dd17ded4dd1920d5ea46b2ed9b7479f50","observation_id":"f83a1f93-6742-4685-86a2-ffb062d6c35f","resolution":{"observed_at":"2026-08-07T15:03:56.463202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.216663Z","title":"Sebis/legal t5 small trans de en small finetuned,","venue":null,"work_id":"df21520b-4478-4428-814e-62b19c4790f2","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.063646Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:611815256c174bd4d77581a78e465c69baca86e81749366a4f991a755880c54d","observation_id":"9c9cfada-9f57-42cf-98db-346ebbcd0df3","resolution":{"observed_at":"2026-08-07T15:03:56.366919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.050839Z","title":"Opus-mt–building open translation services for the world,","venue":null,"work_id":"168a71d6-8543-4322-a345-401190c77266","year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.161308Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a20118ac4fe01e154bd92d8c0bc485a7a3f893b4a0a11297fdc2bd4a53294f32","observation_id":"b54a5b9f-2c17-40fc-99ef-6c359ad4ba0c","resolution":{"observed_at":"2026-08-07T15:03:56.108407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.789126Z","title":"Pontifexmaximus/opus-mt-de-en-finetuned-de-to- en,","venue":null,"work_id":"4ed6ef09-3da6-4e4d-92b7-fde2fb46e112","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.262501Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ec1721d2f327cfcf9be902b4ad767c9e2fb830b3589846dfd872f37dc206cd62","observation_id":"9292c553-dba2-423e-98de-40d047a6e4f1","resolution":{"observed_at":"2026-08-07T15:03:55.888601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10369","last_updated":"2021-06-24T21:46:03Z","snapshot_observed_at":"2026-07-06T09:30:20.579973Z","submitted_at":"2020-06-18T09:06:49Z","title":"Deep Encoder, Shallow Decoder: Reevaluating Non-autoregressive Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10369","snapshot_observed_at":"2026-08-07T15:03:50.344510Z","title":"Deep encoder, shallow decoder: Reevaluating non-autoregressive machine translation,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.344510Z"},"links":{"cited_paper":"/paper/2006.10369","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:2e278c4f47d524ae8649fb6bb3923dc868bcf7aa5b91b9c084b3318210de37e0","observation_id":"e857de65-69ad-4263-bc05-f6268e0d4b55","resolution":{"observed_at":"2026-08-07T15:03:50.344510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.635418Z","title":"allenai/wmt19-de-en-6-6-big,","venue":null,"work_id":"e1ad7592-e1f3-4f47-a2d7-5f572338e232","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.420942Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:09f6e5cab9bbe5bdce072ebade4a55b3abc3252b006551ff806283fed8d93425","observation_id":"4765dce9-ccd9-41b7-aa69-89c984321c81","resolution":{"observed_at":"2026-08-07T15:03:55.739142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.446522Z","title":"Gemel: Model merging for {Memory-Efficient},{Real-Time}video analytics at the edge,","venue":null,"work_id":"fed7625e-0d67-424d-9e11-75240e456744","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.473051Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:2ea1b8da86fd3bdc8950b4a035d1d76bfae6a7f6cb12526a398507867c5d37b5","observation_id":"b6183f22-00e6-4fe2-8953-06717bf382c4","resolution":{"observed_at":"2026-08-07T15:03:55.514483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-07T15:03:50.529765Z","title":"Deberta: Decoding-enhanced bert with disentangled attention,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.529765Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:14bb36d82664946747f02fa49a48d4fc7d4fb94e7624e59ec4ff598cb94d2a28","observation_id":"d1c3d795-ab01-44e4-89d7-028df13f9543","resolution":{"observed_at":"2026-08-07T15:03:50.529765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.337820Z","title":"Tomor0720/deberta-large-finetuned-sst2,","venue":null,"work_id":"1d49aa4b-1477-43cb-a807-a4da709239c9","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.635440Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:cdbc9907a174bf141ae4da87a573cf222bc8e4d0dc6431b99dc19e0abac20845","observation_id":"05c6f0af-f7d8-4661-9b62-3ae1d5606e2f","resolution":{"observed_at":"2026-08-07T15:03:55.429155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:03:50.721809Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.721809Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:b8dbd39d0e22620f533feab4a43aa0aaec6b409616de1ee6e0ceb20ee6f07cd1","observation_id":"e86dc02c-bc97-4a77-9ec9-436605c31069","resolution":{"observed_at":"2026-08-07T15:03:50.721809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.796322Z","title":"Putting gpt-4o to the sword: A comprehensive evaluation of language, vision, speech, and multimodal proficiency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.796322Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:31275490683a32d6b8b5808a1d0d6723508a8395a2d5b4259e2a07002d26cf28","observation_id":"d5d12da1-b643-48a1-9c95-66f896bba4b2","resolution":{"observed_at":"2026-08-07T15:03:50.796322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.905920Z","title":"The Claude 3 Model Family: Opus, Sonnet, Haiku,","venue":null,"work_id":"98fb8694-0fa9-4092-aa8e-68180be2a876","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.874277Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8f4534f1581b89e5da619f7577f20d64a034b689790125db1838f15104a9f7f7","observation_id":"bbf8a3ca-0a4f-473d-880c-27067a4db531","resolution":{"observed_at":"2026-08-07T15:03:55.111327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.577559Z","title":"Claude 3-5 sonnet,","venue":null,"work_id":"bd2acc32-fbb8-4bd6-8284-2e9ff0464117","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.968172Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:276aceb09704d5397d082565927575d3f6b81c1c5cc7299da023fd78970da79d","observation_id":"5854e7ee-e521-4dff-95e9-96367edc2c60","resolution":{"observed_at":"2026-08-07T15:03:54.762321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.355202Z","title":"Claude 3.7 sonnet and claude code,","venue":null,"work_id":"f001d005-7296-4f00-826a-69ba46b9db43","year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.039529Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:9255c7dd75d3b480648927fe6b62ee38526f71c35428df839e906eeb12bf8068","observation_id":"cca37d4c-788b-44c7-a2e9-801bb86db430","resolution":{"observed_at":"2026-08-07T15:03:54.450330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:03:51.107687Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.107687Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:6a12cf3397d9307f0efef89428f2aac3183dbeaed737bb7b922c383c414b8bfb","observation_id":"d8ba2b18-6304-48f0-bf8e-23f17f8cbaba","resolution":{"observed_at":"2026-08-07T15:03:51.107687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:03:51.183361Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.183361Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:632c6b02f7ae4621a2fec6902983dfd172a9d53ba29461cfc6fa24d3ecf53ae8","observation_id":"2b94d8ab-70a8-4f73-bd57-255881fb89c5","resolution":{"observed_at":"2026-08-07T15:03:51.183361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:03:51.256940Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.256940Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a0a803a56f937680a748a4b5e3825c13174aefcc3433f0531a045d54f351f4a8","observation_id":"e501c481-cb94-45b0-9066-3f23633dc684","resolution":{"observed_at":"2026-08-07T15:03:51.256940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T15:03:51.360812Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.360812Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e18493cc6854a7bd04daaa13b3180112890363b19b21886dd6d4ffe0e3568908","observation_id":"9462e46a-9ba2-4910-b1f4-b9eb2df5a1ab","resolution":{"observed_at":"2026-08-07T15:03:51.360812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:03:51.435759Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.435759Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c0fea2bf1fa4fba7db71719894aa1b6895e88cb91b8726f1c8bc5876ca664ca1","observation_id":"4ee98247-1b6a-4d6a-8084-0fd014632580","resolution":{"observed_at":"2026-08-07T15:03:51.435759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:03:51.520129Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.520129Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:dc0e9e717f5479dbc3bdb602f8407e968f1e7a78c590f84f1ff7f8d5f6dc67ed","observation_id":"dc962322-2ba3-459b-a789-cfcb3b29694f","resolution":{"observed_at":"2026-08-07T15:03:51.520129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.604475Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.604475Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:912ed9ee8da89b712543a50917445de1f0b389e30146dd9ad482876c23f49e9a","observation_id":"adb9f63f-b204-4a52-b8ed-c4647ff9b2ba","resolution":{"observed_at":"2026-08-07T15:03:51.604475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.012942Z","title":"Cachegen: Kv cache compression and streaming for fast large language model serving,","venue":null,"work_id":"cb19cee1-9bfd-41a1-ad6d-b04e16bd7be5","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.710780Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e7796485183fc898808c7bbe37be36dbc5e345eef86900041f488faaa8b7bfd8","observation_id":"2e7b4652-3994-40c7-9abe-4ca620038cee","resolution":{"observed_at":"2026-08-07T15:03:54.209398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.651698Z","title":"Adainf: Data drift adaptive scheduling for accurate and slo-guaranteed multiple-model inference serving at edge servers,","venue":null,"work_id":"2091771c-d682-492d-8f4c-bcb6155bce96","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.810104Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ae6182d96da3346270ee505bee0f44f970b2139af4b3189114151c77f6e6c689","observation_id":"cd4f0e96-b6b5-4ba1-aa84-3a8179b0922f","resolution":{"observed_at":"2026-08-07T15:03:53.821441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.901960Z","title":"Edgeshard: Efficient llm inference via collaborative edge computing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.901960Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0fb4a2b4a162b641bb2c1e9e20687fc2399af7e2f712db3ccc2a68201fa292a9","observation_id":"4fe8b1ef-c62d-48d2-8650-553ec3a0855d","resolution":{"observed_at":"2026-08-07T15:03:51.901960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.968328Z","title":"Split computing and early exiting for deep learning applications: Survey and research challenges,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.968328Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:533070852a938d51553f2344b6ab41ce4972a97429499330e7cc02f68c3aba6b","observation_id":"9c7e2b42-09b1-4672-8340-663fd9cfb39d","resolution":{"observed_at":"2026-08-07T15:03:51.968328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.308383Z","title":"Dis- tributed inference acceleration with adaptive dnn partitioning and of- floading,","venue":null,"work_id":"e4cd282f-437b-45c1-bc67-c97a6ea9f34c","year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.045842Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:228c9b43a3d4932903326be6343d56e875f9f1e88e0f57b70fcd7ee9a9587dea","observation_id":"c50d12ed-c54a-421a-9e63-e26fc72b7154","resolution":{"observed_at":"2026-08-07T15:03:53.468802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.125851Z","title":"Mandheling: Mixed-precision on-device dnn training with dsp offloading,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.125851Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:36192536d8858c994d408e9f16b2129636985d22f671f58ccc9b08cf579bd132","observation_id":"e66fac22-0b0a-440f-a0d2-c7a7eeb044e9","resolution":{"observed_at":"2026-08-07T15:03:52.125851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04992","last_updated":"2024-09-08T06:06:44Z","snapshot_observed_at":"2026-08-03T16:41:00.102590Z","submitted_at":"2024-09-08T06:06:44Z","title":"InstInfer: In-Storage Attention Offloading for Cost-Effective Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04992","snapshot_observed_at":"2026-08-07T15:03:52.186188Z","title":"Instinfer: In-storage attention offloading for cost-effective long-context llm inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.186188Z"},"links":{"cited_paper":"/paper/2409.04992","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:148da15a3df4a2dfd528effacbc2f57cac8980612ea9a00bf0cc87e06ece7cc0","observation_id":"3cc82a1b-c19a-45d0-89b6-ae7e0ea360c1","resolution":{"observed_at":"2026-08-07T15:03:52.186188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.076151Z","title":"2214–2218","venue":null,"work_id":"7ce47c37-319d-434d-92c1-7444018db800","year":2012},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.645404Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:b85b511bde8a859d03c74bd46628ba36ba3586fac44da010e40bc09488b953f3","observation_id":"9e56c931-8188-465b-b194-e9f95a871d55","resolution":{"observed_at":"2026-08-07T15:03:57.110516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.014712Z","title":"He was a Visiting Researcher with the School of Com- puting and Communications at Lancaster University, Lancaster, UK from 2018 to 2019","venue":null,"work_id":"47f78385-deac-49fc-b9f5-e665e5101b41","year":2014},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.273544Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:27d75b7585482dd59e378a70dcd1a4cb93c097fb169f464d6ccba63da2d76c95","observation_id":"0b2908a0-dcd3-44e7-8f4b-0bc1549d2200","resolution":{"observed_at":"2026-08-07T15:03:53.133444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-10T20:13:18.649864Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2505.16502."}