Pith. sign in

Paper Citation Record · LEDGER

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework

As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.01126.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01126 v1

Coverage vector

measured 22 of 22 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:33:27.738595Z

measured 22 of 22 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

22 of 22 outbound references displayed

  • verified exact2
  • verified fuzzy8
  • unresolved12
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e2eeb969-5e33-495d-82f2-6c6302f4bac7 · outbound

This paper cites Efficient memory management for large language model serving with PagedAttention,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Efficient memory management for large language model serving with PagedAttention,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.516807Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:25.545991Z digest=sha256:16567d5b636f071454a7ecc5a2d0eea309e308f57cb343c1951a2573415b66ff

Observation 10c5b6ea-ce36-4dd6-bf5a-46eeb3f1a314 · outbound

This paper cites Prompt cache: Modular attention reuse for low-latency inference,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Prompt cache: Modular attention reuse for low-latency inference,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.360620Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:25.692544Z digest=sha256:e172cfa1e8353b57a04879248c52887568effe7ab683c309526bbf09cc8bd4c0

Observation 2aaec917-3eff-47d3-8152-afd367a0b045 · outbound

This paper cites SGLang: Efficient execution of structured language model programs,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework SGLang: Efficient execution of structured language model programs,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:25.843228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:25.843228Z digest=sha256:fcd61257e738080d984dc9ddae27a876a1f27e3df7fd96cae030c0a0b779cd01

Observation 16cb85a0-263c-4a50-83b4-20f1f9a89a89 · outbound

This paper cites Cost-efficient large language model serving for multi-turn conversations with CachedAttention,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Cost-efficient large language model serving for multi-turn conversations with CachedAttention,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.199462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:25.944749Z digest=sha256:150e5998bbf2fabf7625ddac11e40121febda599bafea945eabaf4379a5c4415

Observation 519c1dc4-193f-4fe9-8c12-6d544378171d · outbound

This paper cites Preble: Effi- cient distributed prompt scheduling for LLM serving,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Preble: Effi- cient distributed prompt scheduling for LLM serving,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:30.046872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.036450Z digest=sha256:1d431fcd2c5a13c4af0f84a8ce868865849b5631c82385d8e272f6ce6260ed29

Observation 8ed69102-1abf-4a82-988c-ccbeda51369b · outbound

This paper cites Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.100297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.100297Z digest=sha256:1106e7af0e0ed2b8d7235efe547b0d8d05ce2ae8343d9bbb477f882404144bce

Observation e6cca0e0-e550-412a-a0e0-4fc291032f64 · outbound

This paper cites Shadowserve: Interference-free KV cache fetching for distributed prefix caching,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Shadowserve: Interference-free KV cache fetching for distributed prefix caching,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.224754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.224754Z digest=sha256:1cdba8a05e2570eb4a714c2d39084087d9b324917d77e55108b84371f404b3af

Observation e55ad204-30a7-4234-b30d-e3f1a12614a9 · outbound

This paper cites Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:33:28.675656Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.305491Z digest=sha256:b6fc61f5224c3915eaa7dd45a1c67750ab90cf25cc56fdc008049dfd2c4f5c9b

Observation c7746b22-b539-4273-8750-7f785c0c6357 · outbound

This paper cites Caching placement in stochastic wireless caching helper networks: Channel selection diversity via caching,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Caching placement in stochastic wireless caching helper networks: Channel selection diversity via caching,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.861854Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.401846Z digest=sha256:faed9c858258f2c3a6da740629aa1ed1cb9d47c3de0cccdfe8fd76e5e4a83dca

Observation 868fb934-095d-42f9-b513-5b3b03dd0315 · outbound

This paper cites Probabilistic caching in wireless D2D networks: Cache hit optimal versus throughput optimal,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Probabilistic caching in wireless D2D networks: Cache hit optimal versus throughput optimal,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.514889Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.514751Z digest=sha256:4ea0c906e4cf7146cb4219cfd530ebeceed282e9fdb4eaddf67bc140dbbfc7ee

Observation a046a7f6-bf6a-4b31-836e-aecac1c03b85 · outbound

This paper cites A tractable approach to coverage and rate in cellular networks,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework A tractable approach to coverage and rate in cellular networks,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.586130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.586130Z digest=sha256:38040b5ea340779a216fdb1c86487de04f801169980850cdddd5a0e0c053b141

Observation 23e284de-6843-49b2-91c0-0029b9daa1ca · outbound

This paper cites Haenggi,Stochastic Geometry for Wireless Networks.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Haenggi,Stochastic Geometry for Wireless Networks

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.714751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.714751Z digest=sha256:ffb342b96f138a078fb194a7b97052e844ad9fb8bf968cbe87076f20f486e9ab

Observation 88564840-d7b8-4f20-b6bd-5a0b7403e602 · outbound

This paper cites Keyformer: KV cache reduction through key tokens selection for efficient generative inference,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Keyformer: KV cache reduction through key tokens selection for efficient generative inference,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.338004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.804755Z digest=sha256:71af2b81a3da752efd2731c3baef7f762f34578e36de503fcaf3447f007bf23a

Observation 1997ebb7-4474-4584-8fbe-1213f32c63b6 · outbound

This paper cites Marconi: Prefix Caching for the Era of Hybrid LLMs.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Marconi: Prefix Caching for the Era of Hybrid LLMs

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:26.914749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:26.914749Z digest=sha256:8a6d25cfc902e98deefd01a2eb40ba57ef2c7ae2aa152dba03e0ce4f03427e9c

Observation acff936a-9c9a-4132-9cfa-0c7c262eb75a · outbound

This paper cites Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving,.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:33:29.101849Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:26.976941Z digest=sha256:0e958ad85a5f582b2583e3a4c5dc54a736cde0ea82302939f9612f8e5ecacea9

Observation 979d09f1-5178-4063-8666-bfd273e32561 · outbound

This paper cites Splitwise: Efficient generative LLM inference using phase splitting.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Splitwise: Efficient generative LLM inference using phase splitting

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.077695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.077695Z digest=sha256:de8ec3e25a6e576256db7adc75d444dba37ac9ec9b94b168fb1998d1861f4f18

Observation f74fc455-52c0-43e4-8a25-266a3d78e117 · outbound

This paper cites Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.215748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.215748Z digest=sha256:0536bf7710f23a31eda74b1e6ec3821d37f83871768cd780fd5f1a274020a31b

Observation dee33baa-89dd-4005-8575-75202281c9fe · outbound

This paper cites Llumnix: Dynamic Scheduling for Large Language Model Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Llumnix: Dynamic Scheduling for Large Language Model Serving

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.295482Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.295482Z digest=sha256:d4e8b3e94a460b8228fa9c165175690c2afcb1530106d6e65f77bbd1283e9a4d

Observation 251d395c-dede-4ccd-bd4c-523d8ccf8a65 · outbound

This paper cites MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.394771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.394771Z digest=sha256:37b96e199d7ace553ea5457920429ce5951ad1f295c0cf887eac9cee9ce34993

Observation 7bd48454-58e4-4421-bc62-59bdf493b9ad · outbound

This paper cites KVDirect: Distributed Disaggregated LLM Inference.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework KVDirect: Distributed Disaggregated LLM Inference

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.514901Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.514901Z digest=sha256:57460cb305e060e9233021f09fe9ac2978141e32baf45941964fe2c8887b89df

Observation d8f82b89-0ba8-445c-93ef-2f2041318699 · outbound

This paper cites CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:33:27.633007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:33:27.633007Z digest=sha256:d2f60d8067188a97691bbc72cf8d329ff0a0dc90c5799b71854d7c0bd181070a

Observation c2b26b4b-9773-47df-b952-99168949a7c0 · outbound

This paper cites Towards Distributed Inference of LLMs on a P2P Network.

Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework Towards Distributed Inference of LLMs on a P2P Network

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:33:27.929961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:33:27.738595Z digest=sha256:f7be76940e13bc3c44730943ac8a72ff74e2ef6aec5e2407f46821e3da340911

Pith citing papers

No inbound Pith citation observations are available.