Pith. sign in

Paper Citation Record · LEDGER

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework

As of 13 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.01126.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01126 v1

Coverage vector

measured 22 of 22 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:33:27.738595Z

measured 22 of 22 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

22 of 22 outbound references displayed

  • verified exact2
  • verified fuzzy8
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e2eeb969-5e33-495d-82f2-6c6302f4bac7 · outbound

This paper cites Efficient memory management for large language model serving with PagedAttention,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Efficient memory management for large language model serving with PagedAttention,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.516807Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:25.545991Z digest=sha256:142619a607756d7b467f56eef09ce1ee4e0df25a93839177f6cd042376a1a722

Observation 10c5b6ea-ce36-4dd6-bf5a-46eeb3f1a314 · outbound

This paper cites Prompt cache: Modular attention reuse for low-latency inference,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Prompt cache: Modular attention reuse for low-latency inference,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.360620Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:25.692544Z digest=sha256:75b003929ae32f625654b5bcd3920e828553601c7da3e75299da4c51221d0ab8

Observation 2aaec917-3eff-47d3-8152-afd367a0b045 · outbound

This paper cites SGLang: Efficient execution of structured language model programs,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework SGLang: Efficient execution of structured language model programs,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:25.843228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:25.843228Z digest=sha256:a0dad5511d551bd7be282eeddbb462ee43d2a14bfa9885b75e52e82b67349b31

Observation 16cb85a0-263c-4a50-83b4-20f1f9a89a89 · outbound

This paper cites Cost-efficient large language model serving for multi-turn conversations with CachedAttention,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Cost-efficient large language model serving for multi-turn conversations with CachedAttention,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.199462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:25.944749Z digest=sha256:e1228e0b18a790a6dade6d95a5d6c6f7499cc06256474a2be064c8550536ede3

Observation 519c1dc4-193f-4fe9-8c12-6d544378171d · outbound

This paper cites Preble: Effi- cient distributed prompt scheduling for LLM serving,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Preble: Effi- cient distributed prompt scheduling for LLM serving,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.046872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.036450Z digest=sha256:6873d2f80199bcdd18825390710ace8d80076737117a82c81c256b5da191354a

Observation 8ed69102-1abf-4a82-988c-ccbeda51369b · outbound

This paper cites Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.100297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.100297Z digest=sha256:598d7b9626486e18ee5c12c1893350f34d740ca7143f4d810045ef908e456f44

Observation e6cca0e0-e550-412a-a0e0-4fc291032f64 · outbound

This paper cites Shadowserve: Interference-free KV cache fetching for distributed prefix caching,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Shadowserve: Interference-free KV cache fetching for distributed prefix caching,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.224754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.224754Z digest=sha256:acc4014358b032aa452295da5cd6e64c0b3ab8edb8b517f53cc4c81157ada650

Observation e55ad204-30a7-4234-b30d-e3f1a12614a9 · outbound

This paper cites Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:33:28.675656Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.305491Z digest=sha256:6e04bbaa75886e7de02e2b855bc1cb89278e75aeb867b14f09e84fa1d0083945

Observation c7746b22-b539-4273-8750-7f785c0c6357 · outbound

This paper cites Caching placement in stochastic wireless caching helper networks: Channel selection diversity via caching,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Caching placement in stochastic wireless caching helper networks: Channel selection diversity via caching,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.861854Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.401846Z digest=sha256:312a5954c59a8e40dc9966b7dd7d36fb14b51abdae26fdf945e1271c4f4ac038

Observation 868fb934-095d-42f9-b513-5b3b03dd0315 · outbound

This paper cites Probabilistic caching in wireless D2D networks: Cache hit optimal versus throughput optimal,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Probabilistic caching in wireless D2D networks: Cache hit optimal versus throughput optimal,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.514889Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.514751Z digest=sha256:539941c8947edd54315a7167f4ecb8098537ff3501c3fa35b7c54e7f13eddc7f

Observation a046a7f6-bf6a-4b31-836e-aecac1c03b85 · outbound

This paper cites A tractable approach to coverage and rate in cellular networks,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework A tractable approach to coverage and rate in cellular networks,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.586130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.586130Z digest=sha256:e253f64115a8b522410117800f04c0a7efd57a5a8574f4a873031d1518b020b5

Observation 23e284de-6843-49b2-91c0-0029b9daa1ca · outbound

This paper cites Haenggi,Stochastic Geometry for Wireless Networks.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Haenggi,Stochastic Geometry for Wireless Networks

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.714751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.714751Z digest=sha256:3a6328202cb1d7d1b9684d8473f31a642a50fb8b56ddefc19b3db0be1eb0bcc4

Observation 88564840-d7b8-4f20-b6bd-5a0b7403e602 · outbound

This paper cites Keyformer: KV cache reduction through key tokens selection for efficient generative inference,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Keyformer: KV cache reduction through key tokens selection for efficient generative inference,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.338004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.804755Z digest=sha256:76dbac1f389089e539533c2f5349ef38abab98b003ee49c7e5f2c9bcfacf5fac

Observation 1997ebb7-4474-4584-8fbe-1213f32c63b6 · outbound

This paper cites Marconi: Prefix Caching for the Era of Hybrid LLMs.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Marconi: Prefix Caching for the Era of Hybrid LLMs

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.914749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.914749Z digest=sha256:367898441aff203151f0cd1f2e94c12dccccaa2eb8f7ec7c432feff9dbd71ff8

Observation acff936a-9c9a-4132-9cfa-0c7c262eb75a · outbound

This paper cites Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.101849Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:26.976941Z digest=sha256:1c53a345c46a9302e2227e088aa74ce8e3f215079f34bfb0e237c8f4e45bb602

Observation 979d09f1-5178-4063-8666-bfd273e32561 · outbound

This paper cites Splitwise: Efficient generative LLM inference using phase splitting.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Splitwise: Efficient generative LLM inference using phase splitting

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.077695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.077695Z digest=sha256:434bde72c6d1cb16bea2f4d3951da05ea59ee333d17a57a776468f069b7c4ba5

Observation f74fc455-52c0-43e4-8a25-266a3d78e117 · outbound

This paper cites Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.215748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.215748Z digest=sha256:c6e5c85761877f51b3363cfbd3faa6c9862b120e67d44314a76ec8a0fffc7b2e

Observation dee33baa-89dd-4005-8575-75202281c9fe · outbound

This paper cites Llumnix: Dynamic Scheduling for Large Language Model Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Llumnix: Dynamic Scheduling for Large Language Model Serving

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.295482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.295482Z digest=sha256:3fb048acf13823440a3ea2c799251abda371e6b1f0b64208617bfd432ff0e2ac

Observation 251d395c-dede-4ccd-bd4c-523d8ccf8a65 · outbound

This paper cites MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.394771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.394771Z digest=sha256:5b1936eb26235db8f784d9a547ed7f0dbf867fad37525cd5fb25dbcfb420d0e3

Observation 7bd48454-58e4-4421-bc62-59bdf493b9ad · outbound

This paper cites KVDirect: Distributed Disaggregated LLM Inference.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework KVDirect: Distributed Disaggregated LLM Inference

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.514901Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.514901Z digest=sha256:3c0f80b6e1b15a10e53aa2a14f19fc7ca33c2ce42f6017f29223517cfa6128b7

Observation d8f82b89-0ba8-445c-93ef-2f2041318699 · outbound

This paper cites CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.633007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.633007Z digest=sha256:0d6e8ad5888890cebfd2836c4da97942dd1da6b217432798c2494d6fa9c937cb

Observation c2b26b4b-9773-47df-b952-99168949a7c0 · outbound

This paper cites Towards Distributed Inference of LLMs on a P2P Network.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Towards Distributed Inference of LLMs on a P2P Network

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:33:27.929961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-06T00:33:27.738595Z digest=sha256:e486a85b3beeeefbd8a5339b5ff67149bebc934a13e0dd73dc36c212834f2050

Pith citing papers

No inbound Pith citation observations are available.