{"as_of":"2026-08-09T18:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa0255e434098620510874a6265fe55ad330a242adb02899f7bd7414143327d7","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:33:27.738595Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01126/citation-record","integrity":"/paper/2608.01126/integrity","json":"/paper/2608.01126/citation-record.json","paper":"/paper/2608.01126"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:30.434783Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":"529b5c67-f904-4b10-9f78-2a8cb7b30463","year":2023},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:25.545991Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:16567d5b636f071454a7ecc5a2d0eea309e308f57cb343c1951a2573415b66ff","observation_id":"e2eeb969-5e33-495d-82f2-6c6302f4bac7","resolution":{"observed_at":"2026-08-06T00:33:30.516807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:30.277217Z","title":"Prompt cache: Modular attention reuse for low-latency inference,","venue":null,"work_id":"c2b3c37c-cacb-4d35-b05f-0403ebb41596","year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:25.692544Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:e172cfa1e8353b57a04879248c52887568effe7ab683c309526bbf09cc8bd4c0","observation_id":"10c5b6ea-ce36-4dd6-bf5a-46eeb3f1a314","resolution":{"observed_at":"2026-08-06T00:33:30.360620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:25.843228Z","title":"SGLang: Efficient execution of structured language model programs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:25.843228Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:fcd61257e738080d984dc9ddae27a876a1f27e3df7fd96cae030c0a0b779cd01","observation_id":"2aaec917-3eff-47d3-8152-afd367a0b045","resolution":{"observed_at":"2026-08-06T00:33:25.843228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:30.123335Z","title":"Cost-efficient large language model serving for multi-turn conversations with CachedAttention,","venue":null,"work_id":"46521c65-2d68-4220-86a0-23a9a57f9425","year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:25.944749Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:150e5998bbf2fabf7625ddac11e40121febda599bafea945eabaf4379a5c4415","observation_id":"16cb85a0-263c-4a50-83b4-20f1f9a89a89","resolution":{"observed_at":"2026-08-06T00:33:30.199462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:29.976378Z","title":"Preble: Effi- cient distributed prompt scheduling for LLM serving,","venue":null,"work_id":"e057978e-7eb8-456f-b95d-ab501b2fe757","year":2025},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.036450Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:1d431fcd2c5a13c4af0f84a8ce868865849b5631c82385d8e272f6ce6260ed29","observation_id":"519c1dc4-193f-4fe9-8c12-6d544378171d","resolution":{"observed_at":"2026-08-06T00:33:30.046872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00079","last_updated":"2025-09-03T14:56:29Z","snapshot_observed_at":"2026-08-07T12:08:57.217593Z","submitted_at":"2024-06-24T02:05:32Z","title":"Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00079","snapshot_observed_at":"2026-08-06T00:33:26.100297Z","title":"Mooncake: A KVCache-centric disaggregated architecture for LLM serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.100297Z"},"links":{"cited_paper":"/paper/2407.00079","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:1106e7af0e0ed2b8d7235efe547b0d8d05ce2ae8343d9bbb477f882404144bce","observation_id":"8ed69102-1abf-4a82-988c-ccbeda51369b","resolution":{"observed_at":"2026-08-06T00:33:26.100297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:26.224754Z","title":"Shadowserve: Interference-free KV cache fetching for distributed prefix caching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.224754Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:1cdba8a05e2570eb4a714c2d39084087d9b324917d77e55108b84371f404b3af","observation_id":"e6cca0e0-e550-412a-a0e0-4fc291032f64","resolution":{"observed_at":"2026-08-06T00:33:26.224754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22812","last_updated":"2026-04-10T13:49:34Z","snapshot_observed_at":"2026-08-07T02:45:50.573825Z","submitted_at":"2026-02-26T09:53:17Z","title":"Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching","version":2},"cited_work":{"arxiv_id":"2602.22812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.22812","snapshot_observed_at":"2026-08-06T00:33:28.604075Z","title":"Accelerating Local LLMs on Resource-Constrained Edge Devices via Distributed Prompt Caching","venue":"cs.LG","work_id":"128e08b4-f308-419c-8957-5321c0579fa8","year":2026},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.305491Z"},"links":{"cited_paper":"/paper/2602.22812","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:b6fc61f5224c3915eaa7dd45a1c67750ab90cf25cc56fdc008049dfd2c4f5c9b","observation_id":"e55ad204-30a7-4234-b30d-e3f1a12614a9","resolution":{"observed_at":"2026-08-06T00:33:28.675656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:29.705053Z","title":"Caching placement in stochastic wireless caching helper networks: Channel selection diversity via caching,","venue":null,"work_id":"7602dfc9-49c5-48be-899b-c31118267ac8","year":2016},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.401846Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:faed9c858258f2c3a6da740629aa1ed1cb9d47c3de0cccdfe8fd76e5e4a83dca","observation_id":"c7746b22-b539-4273-8750-7f785c0c6357","resolution":{"observed_at":"2026-08-06T00:33:29.861854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:29.443524Z","title":"Probabilistic caching in wireless D2D networks: Cache hit optimal versus throughput optimal,","venue":null,"work_id":"1058027e-f81e-4dd5-bf1f-381a5d27c614","year":2017},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.514751Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:4ea0c906e4cf7146cb4219cfd530ebeceed282e9fdb4eaddf67bc140dbbfc7ee","observation_id":"868fb934-095d-42f9-b513-5b3b03dd0315","resolution":{"observed_at":"2026-08-06T00:33:29.514889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:26.586130Z","title":"A tractable approach to coverage and rate in cellular networks,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.586130Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:38040b5ea340779a216fdb1c86487de04f801169980850cdddd5a0e0c053b141","observation_id":"a046a7f6-bf6a-4b31-836e-aecac1c03b85","resolution":{"observed_at":"2026-08-06T00:33:26.586130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:26.714751Z","title":"Haenggi,Stochastic Geometry for Wireless Networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.714751Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:ffb342b96f138a078fb194a7b97052e844ad9fb8bf968cbe87076f20f486e9ab","observation_id":"23e284de-6843-49b2-91c0-0029b9daa1ca","resolution":{"observed_at":"2026-08-06T00:33:26.714751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:29.224322Z","title":"Keyformer: KV cache reduction through key tokens selection for efficient generative inference,","venue":null,"work_id":"9ca8289f-a24b-4773-add4-83bfc4d90c09","year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.804755Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:71af2b81a3da752efd2731c3baef7f762f34578e36de503fcaf3447f007bf23a","observation_id":"88564840-d7b8-4f20-b6bd-5a0b7403e602","resolution":{"observed_at":"2026-08-06T00:33:29.338004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19379","last_updated":"2025-04-10T05:06:29Z","snapshot_observed_at":"2026-07-06T19:58:39.778401Z","submitted_at":"2024-11-28T21:10:20Z","title":"Marconi: Prefix Caching for the Era of Hybrid LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19379","snapshot_observed_at":"2026-08-06T00:33:26.914749Z","title":"Marconi: Prefix caching for the era of hybrid LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.914749Z"},"links":{"cited_paper":"/paper/2411.19379","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:8a6d25cfc902e98deefd01a2eb40ba57ef2c7ae2aa152dba03e0ce4f03427e9c","observation_id":"1997ebb7-4474-4584-8fbe-1213f32c63b6","resolution":{"observed_at":"2026-08-06T00:33:26.914749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:33:28.954771Z","title":"Distserve: Disaggregating prefill and decoding for goodput- optimized large language model serving,","venue":null,"work_id":"8543f229-21cb-43d0-894a-5585da8b2fc5","year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:26.976941Z"},"links":{"citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:0e958ad85a5f582b2583e3a4c5dc54a736cde0ea82302939f9612f8e5ecacea9","observation_id":"acff936a-9c9a-4132-9cfa-0c7c262eb75a","resolution":{"observed_at":"2026-08-06T00:33:29.101849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-08-06T12:06:11.068182Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-08-06T00:33:27.077695Z","title":"Splitwise: Efficient generative LLM inference using phase splitting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.077695Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:de8ec3e25a6e576256db7adc75d444dba37ac9ec9b94b168fb1998d1861f4f18","observation_id":"979d09f1-5178-4063-8666-bfd273e32561","resolution":{"observed_at":"2026-08-06T00:33:27.077695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02310","last_updated":"2024-06-17T21:10:46Z","snapshot_observed_at":"2026-08-09T18:41:19.236224Z","submitted_at":"2024-03-04T18:47:08Z","title":"Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02310","snapshot_observed_at":"2026-08-06T00:33:27.215748Z","title":"Taming throughput-latency tradeoff in LLM inference with Sarathi-Serve,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.215748Z"},"links":{"cited_paper":"/paper/2403.02310","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:97c2fb6cd877a49e8b5e5dad4763abf1b5064fc8560b1e0f5d0e0d496d705b83","observation_id":"f74fc455-52c0-43e4-8a25-266a3d78e117","resolution":{"observed_at":"2026-08-06T00:33:27.215748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03243","last_updated":"2024-06-05T13:20:18Z","snapshot_observed_at":"2026-08-09T17:24:50.590530Z","submitted_at":"2024-06-05T13:20:18Z","title":"Llumnix: Dynamic Scheduling for Large Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03243","snapshot_observed_at":"2026-08-06T00:33:27.295482Z","title":"Llumnix: Dynamic scheduling for large language model serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.295482Z"},"links":{"cited_paper":"/paper/2406.03243","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:f8c1705dfd692f30d3c7558626f26bce615f86a5e6c4ded7849f53f9cd48d40f","observation_id":"dee33baa-89dd-4005-8575-75202281c9fe","resolution":{"observed_at":"2026-08-06T00:33:27.295482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-07-06T18:36:42.830927Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-06T00:33:27.394771Z","title":"Memserve: Context caching for dis- aggregated LLM serving with elastic memory pool,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.394771Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:37b96e199d7ace553ea5457920429ce5951ad1f295c0cf887eac9cee9ce34993","observation_id":"251d395c-dede-4ccd-bd4c-523d8ccf8a65","resolution":{"observed_at":"2026-08-06T00:33:27.394771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14743","last_updated":"2024-12-13T21:54:16Z","snapshot_observed_at":"2026-08-05T05:05:35.758967Z","submitted_at":"2024-12-13T21:54:16Z","title":"KVDirect: Distributed Disaggregated LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14743","snapshot_observed_at":"2026-08-06T00:33:27.514901Z","title":"KVDirect: Distributed disaggregated LLM inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.514901Z"},"links":{"cited_paper":"/paper/2501.14743","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:57460cb305e060e9233021f09fe9ac2978141e32baf45941964fe2c8887b89df","observation_id":"7bd48454-58e4-4421-bc62-59bdf493b9ad","resolution":{"observed_at":"2026-08-06T00:33:27.514901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07240","last_updated":"2024-07-19T21:04:14Z","snapshot_observed_at":"2026-08-07T17:46:33.336201Z","submitted_at":"2023-10-11T07:08:20Z","title":"CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07240","snapshot_observed_at":"2026-08-06T00:33:27.633007Z","title":"Cachegen: KV cache compression and streaming for fast large language model serving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.633007Z"},"links":{"cited_paper":"/paper/2310.07240","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:d2f60d8067188a97691bbc72cf8d329ff0a0dc90c5799b71854d7c0bd181070a","observation_id":"d8f82b89-0ba8-445c-93ef-2f2041318699","resolution":{"observed_at":"2026-08-06T00:33:27.633007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.17059","last_updated":"2026-05-07T15:40:51Z","snapshot_observed_at":"2026-08-07T15:57:03.163515Z","submitted_at":"2026-05-07T15:40:51Z","title":"Towards Distributed Inference of LLMs on a P2P Network","version":1},"cited_work":{"arxiv_id":"2606.17059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.17059","snapshot_observed_at":"2026-08-06T00:33:27.844013Z","title":"Towards Distributed Inference of LLMs on a P2P Network","venue":"cs.DC","work_id":"5d95d521-1e7a-4408-887a-08f0b5a2793a","year":2026},"citing_paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:33:27.738595Z"},"links":{"cited_paper":"/paper/2606.17059","citing_paper":"/paper/2608.01126"},"observation_digest":"sha256:f7be76940e13bc3c44730943ac8a72ff74e2ef6aec5e2407f46821e3da340911","observation_id":"c2b26b4b-9773-47df-b952-99168949a7c0","resolution":{"observed_at":"2026-08-06T00:33:27.929961Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01126","last_updated":"2026-08-02T09:51:15Z","latest_version":1,"primary_category":"cs.IT","snapshot_observed_at":"2026-08-09T00:37:13.692433Z","submitted_at":"2026-08-02T09:51:15Z","title":"Spatial Prefix Caching for Wireless Edge LLM Inference: A Stochastic-Geometry and Queueing Framework"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":8},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2608.01126."}