{"as_of":"2026-08-18T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4afe1d06e39efbc29f129b8528711a3220bc25663f8ae42a9e25d559750a5b82","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:57:59.591445Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:16:14.906505Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T21:16:15.431897Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"cited_work":{"arxiv_id":"2505.18164","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18164","snapshot_observed_at":"2026-08-06T21:16:15.431897Z","title":"Model-Distributed Inference for Large Language Models at the Edge","venue":"cs.LG","work_id":"8e9236ac-dfd4-4f63-aad0-895d7c3b368b","year":2025},"citing_paper":{"arxiv_id":"2507.00672","last_updated":"2025-07-01T11:13:56Z","snapshot_observed_at":"2026-08-14T07:42:42.213803Z","submitted_at":"2025-07-01T11:13:56Z","title":"Toward Edge General Intelligence with Multiple-Large Language Model (Multi-LLM): Architecture, Trust, and Orchestration","version":1},"reference_index":127,"source":"pdf_text","source_observed_at":"2026-08-06T21:16:14.906505Z"},"links":{"cited_paper":"/paper/2505.18164","citing_paper":"/paper/2507.00672"},"observation_digest":"sha256:8d5fbbaf8efa1424c9bba1329313714562ed8af2da6fe323df628c13741fa3dd","observation_id":"7b35db66-90a4-48d3-ba5b-4a2e966d2243","resolution":{"observed_at":"2026-08-06T21:16:15.435190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18164","snapshot_observed_at":"2026-08-03T11:01:43.546924Z","title":"Model-Distributed Inference for Large Language Models at the Edge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07978","last_updated":"2026-07-13T12:55:23Z","snapshot_observed_at":"2026-08-03T11:01:42.993651Z","submitted_at":"2026-01-12T20:20:35Z","title":"Cost and Accuracy of Long-Term Memory in Distributed Multi-Agent Systems Based on Large Language Models","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T11:01:43.546924Z"},"links":{"cited_paper":"/paper/2505.18164","citing_paper":"/paper/2601.07978"},"observation_digest":"sha256:814eaaf6c815222466fae59d28e48eb9c5f506cd311f8b156003897dd33f8815","observation_id":"14eb9ad3-7754-4145-83bc-fda54e6cdfab","resolution":{"observed_at":"2026-08-03T11:01:43.546924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18164/citation-record","integrity":"/paper/2505.18164/integrity","json":"/paper/2505.18164/citation-record.json","paper":"/paper/2505.18164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.446989Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.446989Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:109cdb3bc2ccfb5775b37bb5b7e175674153b2067588b865c2bedf2baa59d717","observation_id":"95637eb9-92c5-4d3d-bab9-e2531ce3eac7","resolution":{"observed_at":"2026-08-15T21:57:59.446989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.452822Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.452822Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:b6cf9302aa709349c068496a046f0ead08e7c6fd3403148aefe9db47aa944b0a","observation_id":"f677d7dd-cf37-41b8-90d2-cee6e4d20c7b","resolution":{"observed_at":"2026-08-15T21:57:59.452822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.123112Z","title":"Palm: Scaling language modeling with pathways,","venue":null,"work_id":"313d4f3c-4d01-47c1-ae5d-a27b5e874614","year":2022},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.457904Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:32a01643de12f775236bf27c638cf4544281e98c5cbe0b94dd8b84514db98849","observation_id":"c9126483-bd56-4215-b064-45f795f66e98","resolution":{"observed_at":"2026-08-15T21:58:00.128150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3555802","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.640751Z","title":"Edge computing with artificial intelligence: A machine learning perspective,","venue":null,"work_id":"2febc24b-fd36-4cb4-8260-033e7cce8bd4","year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.462898Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:60cd252917067bb4f165c3fb5926b09f3b1ee1aa8fb9dafdd4d3343fdb16ac06","observation_id":"62312ee9-7914-4f91-a4aa-938103d337b9","resolution":{"observed_at":"2026-08-15T21:57:59.645945Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.468058Z","title":"Deep learning with edge computing: A review,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.468058Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:48894c658545baa4b97e47df6cb752a67206597441568e637086a56330ae8bbb","observation_id":"628398d8-aa36-40d5-914a-5c042902a590","resolution":{"observed_at":"2026-08-15T21:57:59.468058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.092406Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism,","venue":null,"work_id":"dfd15be7-00d0-44a9-a879-396db36164dd","year":2020},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.473452Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:e7760138fb7bac5775db3b3e4f8d4f00c2e561df856bda3c40bc5307bc123ae7","observation_id":"d4944daa-c623-493e-8653-f6ca9c93b565","resolution":{"observed_at":"2026-08-15T21:58:00.097966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.479627Z","title":"Tesseract: Parallelize the tensor parallelism efficiently,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.479627Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:6d9f5f3d25ebb1997bde67efbd5723a675e96c00e4afe71689f3cd0c7b2a778f","observation_id":"e7353d3f-ed2c-4b53-91a0-4a9decf6ce73","resolution":{"observed_at":"2026-08-15T21:57:59.479627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.073678Z","title":"Efficient and robust parallel dnn training through model parallelism on multi-gpu platform,","venue":null,"work_id":"59eaced2-4998-47fe-8217-ffc1ef68e4c1","year":2019},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.485079Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:a0960fcbedbe84d677bf912788a45417b7f1a3acd590bcb87d64bbf9589ca481","observation_id":"61e18f29-fff9-40e2-b615-4b3415000108","resolution":{"observed_at":"2026-08-15T21:58:00.080231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.06965","last_updated":"2019-07-25T21:42:58Z","snapshot_observed_at":"2026-08-17T19:36:58.372516Z","submitted_at":"2018-11-16T18:43:28Z","title":"GPipe: Efficient Training of Giant Neural Networks using Pipeline Parallelism","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.06965","snapshot_observed_at":"2026-08-15T21:57:59.489906Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.489906Z"},"links":{"cited_paper":"/paper/1811.06965","citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:a713ced09c0443115e9bf71cb1beaeaba2a2afea5ac5601d772c6bf8c3d2515e","observation_id":"d89b69c4-595d-42d1-9a10-03446c5873c7","resolution":{"observed_at":"2026-08-15T21:57:59.489906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.052427Z","title":"Pipeline parallelism for inference on heterogeneous edge computing,","venue":null,"work_id":"d0a3c404-5c8b-4482-aea5-9ba42057c925","year":2021},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.495264Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:a0d049a089dfcd9bc3519e41ad4785d31d03ff6de27ff3ee2143a747027ab6af","observation_id":"495f69a9-0b90-4244-961e-78685448aac1","resolution":{"observed_at":"2026-08-15T21:58:00.058387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.032087Z","title":"Respipe: Resilient model- distributed dnn training at edge networks,","venue":null,"work_id":"78904c64-97b2-4b3d-ab67-29c4861517ee","year":2021},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.500094Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:a9de668ad70470b5822ab24443fd37c30fc205769101ef2c8675e95b5b42c01d","observation_id":"646ad772-f0d2-41f4-8273-e5ad48b47032","resolution":{"observed_at":"2026-08-15T21:58:00.038579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:58:00.001878Z","title":"Adaptive and resilient model-distributed inference in edge computing systems,","venue":null,"work_id":"5cdb6490-b42c-4473-aa11-d9e51f426806","year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.504949Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:1380fc30dc2e213b3e4a8609295bb235a85e9265589abc44913838c0db58097a","observation_id":"49e96633-c261-4468-838e-cdfdace489ee","resolution":{"observed_at":"2026-08-15T21:58:00.009187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.509682Z","title":"Model-distributed inference in multi-source edge networks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.509682Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:09c6d9afed18473e07fe251acfee640678d64a1d5a0453b01b459c974f118056","observation_id":"b72e0b55-87bd-4ba4-8324-db20f1c1d60a","resolution":{"observed_at":"2026-08-15T21:57:59.509682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.974255Z","title":"Early-exit meets model- distributed inference at edge networks,","venue":null,"work_id":"8f6e33c7-aeab-4ef8-ab50-86bc1f24a77d","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.514654Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:6a06873fe74ccb932d003a5d0fd6d4f73238f14780db9c0378a54fdf22a4e21b","observation_id":"01d6f3d0-6451-421b-b438-94c350ed7985","resolution":{"observed_at":"2026-08-15T21:57:59.979272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12371","last_updated":"2024-12-16T22:01:55Z","snapshot_observed_at":"2026-08-18T02:28:59.212683Z","submitted_at":"2024-12-16T22:01:55Z","title":"Priority-Aware Model-Distributed Inference at Edge Networks","version":1},"cited_work":{"arxiv_id":"2412.12371","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.12371","snapshot_observed_at":"2026-08-15T21:57:59.678910Z","title":"Priority-Aware Model-Distributed Inference at Edge Networks","venue":"cs.DC","work_id":"080f2708-d9d7-4497-b84a-e62b1eb4df34","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.519205Z"},"links":{"cited_paper":"/paper/2412.12371","citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:aee70dc87778a4637adad2f3aeb2f0d4df0e38526f5f462eb09979c79399397c","observation_id":"d0c57d17-cda0-446e-ab07-3b4cbedb9bc2","resolution":{"observed_at":"2026-08-15T21:57:59.684478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.958650Z","title":"Efficiently scaling transformer inference,","venue":null,"work_id":"ff5aca65-60fc-4810-a372-29db7b42b449","year":2022},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.524408Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:2af2fb8ea531d0dad20606ef11049e76b8372e91236a15ec40ecf4cddf7a406a","observation_id":"14195f80-d71e-4424-8732-3eba3a9f4336","resolution":{"observed_at":"2026-08-15T21:57:59.963966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.942814Z","title":"Gqa: Training generalized multi-query transformer models from multi-head checkpoints,","venue":null,"work_id":"3a0efa8b-b46c-4a06-94f6-c5b0cb61dbb9","year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.529165Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:8d047d3866cb1d3a767029de79c35d3cc0ddcb090016ad097a13a565a777a2a1","observation_id":"5768090c-0044-472a-92ff-75559bcc1522","resolution":{"observed_at":"2026-08-15T21:57:59.947990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.533635Z","title":"A survey of quantization methods for efficient neural network inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.533635Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:bab916856c8f7561124b2ab48a0132ba80203f4cdab7b8c38af5d0d729e5265d","observation_id":"12fd596c-2555-4dc8-b749-bd36759556d0","resolution":{"observed_at":"2026-08-15T21:57:59.533635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.916731Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving,","venue":null,"work_id":"e69b6518-f24c-40b8-a77d-2f915f041394","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.538266Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:9e03f438371f8f1aedfca84c94aa0803c7c361f198ce95ca0757e92eae9d8047","observation_id":"e753efd3-1895-40fd-bd45-6de56050f48c","resolution":{"observed_at":"2026-08-15T21:57:59.921588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.900826Z","title":"Com- pressing llms: The truth is rarely pure and never simple,","venue":null,"work_id":"9fba2b81-5d48-4807-bc07-528a2245220c","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.542974Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:57cc4866c8c9303e279aaff67d79792c02f0bf91bf98b9d471e9acc58c3f6c82","observation_id":"66584ea7-29b5-4791-b23f-eb5406095174","resolution":{"observed_at":"2026-08-15T21:57:59.905881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.885274Z","title":"A simple and effective pruning approach for large language models,","venue":null,"work_id":"d71eec67-4d3d-47ab-8245-b336c0c5b245","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.547707Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:3bc6614b788d88fa828c5676781c8513a0dcbe2f9e8304126c7eba7451d3b561","observation_id":"76e974f7-9517-4dde-82cf-cac69f9d99e2","resolution":{"observed_at":"2026-08-15T21:57:59.890106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.552584Z","title":"Knowledge distillation: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.552584Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:8b6ffb56edcfffe13545bb4006ad4266305dfe177d40efa880c667bbf1040580","observation_id":"dc6b8f19-16fc-4c42-9c22-94d6d900600d","resolution":{"observed_at":"2026-08-15T21:57:59.552584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14895","last_updated":"2021-10-28T05:20:51Z","snapshot_observed_at":"2026-08-16T17:45:51.746296Z","submitted_at":"2021-10-28T05:20:51Z","title":"Pipeline Parallelism for Inference on Heterogeneous Edge Computing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14895","snapshot_observed_at":"2026-08-15T21:57:59.557241Z","title":"Pipeline parallelism for inference on heterogeneous edge computing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.557241Z"},"links":{"cited_paper":"/paper/2110.14895","citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:960a536b53bd51a4eb1addee4f0ad5292859bdee7d75c8343745d2b0e0fe160a","observation_id":"94f4f844-eae4-4af8-acb1-9b8793d968ff","resolution":{"observed_at":"2026-08-15T21:57:59.557241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.858540Z","title":"Jarvis: Disjoint large language models on radio vlans for intelligent services,","venue":null,"work_id":"56e01052-6216-4b79-b06a-5ae431a1478e","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.562331Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:efa2567289b0d1f3c8d09fd80c01899cf1fefacc4bda5de57aee0269ad0317e0","observation_id":"4481ed09-e22b-4071-8b96-cf09fcaa5ae2","resolution":{"observed_at":"2026-08-15T21:57:59.863526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3656041","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.622665Z","title":"Edgeci: Distributed workload assignment and model partitioning for cnn inference on edge clusters,","venue":null,"work_id":"1631a152-d776-461c-812c-aa6ddf661ac7","year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.567084Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:30cffd2545a8458b5f653578726061ccd78c7ca477722663f0467ff3733d3de1","observation_id":"824619dc-b6ec-415b-9ae0-76294125196d","resolution":{"observed_at":"2026-08-15T21:57:59.629432Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.842376Z","title":"AI, “Litgpt,” https://github.com/Lightning-AI/litgpt, 2023","venue":null,"work_id":"3926d5fc-1d81-470c-863f-ab1e97bc4bfa","year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.572059Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:ff18c51e1b9bf12baba6c1ee12b405b1b81d8a12865272864a6b64a2d5b3715e","observation_id":"a00ff37b-bc4f-4216-83d0-6cb2ca967f7b","resolution":{"observed_at":"2026-08-15T21:57:59.848123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.826022Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":"c2511da8-7ed1-46e1-84a5-bd52a3dae29d","year":2023},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.576967Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:c7b8704b32a32d6f7226cf6b9a98f20874c30e9c6bd671e98a0e1487215223e2","observation_id":"bfa5025b-4f3b-4df9-963b-48539e8a071e","resolution":{"observed_at":"2026-08-15T21:57:59.831810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.810442Z","title":"Jetson tx2 technical specifications,","venue":null,"work_id":"84c4a32a-f810-41ce-a5ea-b85d94a1c59d","year":null},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.581712Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:d62bca250c8d775e759ad0bc2cb01986d4e19bd027d5436c5a672b9441d00b0f","observation_id":"d1d2f354-98a1-4397-8959-029bfb0edbc3","resolution":{"observed_at":"2026-08-15T21:57:59.815353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.793805Z","title":"Tiny shakespeare data set,","venue":null,"work_id":"20f3cf45-af91-4f3a-843a-ffb489630f16","year":2015},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.586485Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:8523465d0e1bcdd741ea7d794d3d7fd482dc577e4dce0fd222b87fbced44f00b","observation_id":"1f67f47d-9106-4c7c-9f10-de08eac0335f","resolution":{"observed_at":"2026-08-15T21:57:59.798567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:57:59.591445Z","title":"Tinyllama: An open-source small language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:57:59.591445Z"},"links":{"citing_paper":"/paper/2505.18164"},"observation_digest":"sha256:513f05d7563dc1232b11b2d246a6fe94595f695f78638e1026db7a85d380428c","observation_id":"33e59ab2-bef1-4725-98f0-ed11d968fd2e","resolution":{"observed_at":"2026-08-15T21:57:59.591445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18164","last_updated":"2025-05-13T12:07:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T04:28:27.169235Z","submitted_at":"2025-05-13T12:07:37Z","title":"Model-Distributed Inference for Large Language Models at the Edge"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 2 inbound Pith citation observations for arXiv:2505.18164."}