Pith. sign in

Paper Citation Record · LEDGER

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch

As of 20 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2607.26475.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.26475 v1

Coverage vector

measured 44 of 44 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-01T15:06:54.344008Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

44 of 44 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved43
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4c452bd7-4d8b-4f78-9cd6-342c182fa6bf · outbound

This paper cites Gulavani, Alexey Tumanov, and Ramachandran Ramjee.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Gulavani, Alexey Tumanov, and Ramachandran Ramjee

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.170950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.170950Z digest=sha256:f82b5e446d42643033e3b726dd5d7cc598015d9c99e8c6d3659c948b0366aa0e

Observation 4eefe7e0-0764-45e4-9a18-fab534c0bd48 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.175744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.175744Z digest=sha256:296fc1f3fcdd448c8020b1bada748b4315b52446bdcf6eda6b370be3c741d11e

Observation 2564b0b3-500b-440b-889f-443761bd7ee2 · outbound

This paper cites DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.180960Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.180960Z digest=sha256:a1908053106d4a6f148c14d61133e133edc3f681ca32c90791212af5d7227d65

Observation 1b8efbff-a2fb-4b46-9da0-d096620cbe75 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.185869Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.185869Z digest=sha256:0bb29eb09f5305dbe59a9a1a1929f9621c1fc07369d944d08ddfb65bdf5934c2

Observation 09fd9b61-80b0-4d90-87a5-7115e6cec634 · outbound

This paper cites Aly, Beidi Chen, and Carole-Jean Wu.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Aly, Beidi Chen, and Carole-Jean Wu

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.189836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.189836Z digest=sha256:921724d795209b5e9f88ba11da3a1150f1863fd496b82db079fd2a19c2575226

Observation 79958e84-a838-4fb0-9351-44aeacdc9073 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.197927Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.197927Z digest=sha256:a2cbbd32f8ad435cff53a43e1af4f5ce9ddc9c9894047b0834824394503caa1b

Observation bf9e74ee-e9f3-48cb-9228-bfd48a7098dc · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.202233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.202233Z digest=sha256:3433a3acb8925345eca0a247e5b68b3fb2dc80847d877063ab3da6b88a35d22c

Observation 1183dc5a-ecb9-466f-a6ce-67d9c5e53850 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.205989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.205989Z digest=sha256:689e6e6fa08e5a5d7bcd17dd3ee93d5a834d0b8a343868a65e37f679eebf4205

Observation 63dae347-e822-4f8a-80ad-d723fa99cf1c · outbound

This paper cites FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.210093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.210093Z digest=sha256:001ff02b2ba458ab3db0cb090ab975d8cf32767c85fb6a858f5cd2e1521a010d

Observation 98423e8e-b5ee-4fd2-b5e6-4ba7a0d74e38 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.214313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.214313Z digest=sha256:d3c83787df9e4fce59d26e8c125d61181332e6b97cb720244f182978bb45597f

Observation 9748d17e-21b8-4f59-9696-5cf628b8f66f · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.218393Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.218393Z digest=sha256:ebdcadf1646053974e54bc86da992ab1e6a957c5ed730a11b19670c2010b06fa

Observation 98f1939f-4852-44c6-ad80-d2c249913367 · outbound

This paper cites MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.222623Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.222623Z digest=sha256:37c303f2c2dadca24d39acd5d354f546d40e1fb66f2f3fe3a00828988c2cc902

Observation 97335c9f-704d-411d-95ee-3218daf482ac · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.226779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.226779Z digest=sha256:22bcf77e5b3b2f36b9271d2182b4d48fdfefc85c121f5953c987ccfc1eff41ae

Observation 9a07d110-f620-40dc-8898-f37a195a2a7f · outbound

This paper cites Gonzalez, Hao Zhang, and Ion Stoica.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Gonzalez, Hao Zhang, and Ion Stoica

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.230724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.230724Z digest=sha256:631ba7739be8b0f8b997ec4c88833f412b49a0dcb4ff73a454028c271d58c5d4

Observation 33b7382a-6022-4121-be07-fe8c73787743 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.239207Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.239207Z digest=sha256:6b8da46eb18d1d2f1d830c58fa34e61e62a546d36b7e4a49d581a2694c4191ab

Observation d228155d-2d7a-4eef-938f-e03a7647ae9e · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.243103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.243103Z digest=sha256:dd11fe79381a3c342589223f84d3931e5bac0970f79bc87dc698c036da07da43

Observation 23479e2f-7291-4257-8865-668f9463c5ce · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.247010Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.247010Z digest=sha256:fba77add1cd72f987237939d503d4de5fe3644aa892bcd7ed380fb558cbb0c0e

Observation e252f059-912e-4cba-8b5d-bd908f8bb083 · outbound

This paper cites MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.250769Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.250769Z digest=sha256:af1c6ccb2531d0ba328a18e902396bfdd6c55fb0c97f3b85f88c9ee9cc36ddf3

Observation 792b288a-5629-4875-a7a3-0eadd081c27c · outbound

This paper cites RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.254928Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.254928Z digest=sha256:13771d40460359655d85aa8c35891423d0da245da53b27d17f10d0561e88c217

Observation 2bd00e49-b66c-4432-a6a7-56c0a2b9944f · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.259154Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.259154Z digest=sha256:b0f656bb3b090247b3959a1306fada53f5c69a3576262a40f6c6fc37b6f59727

Observation ddc9f0db-8cf0-45c3-a86e-272a458abfc8 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.262956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.262956Z digest=sha256:3de3e2527052dc072c77e4de6419ddf4b12f92531c5bd0622159ddc62411d3aa

Observation 09843e44-e451-4ba3-a1d9-21da068b0745 · outbound

This paper cites The Llama 3 Herd of Models.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch The Llama 3 Herd of Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.266552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.266552Z digest=sha256:9b2cf90f5af9c0cd1a44c69eb68539c0c736ea7f53acb188fc06ef945a53bfc9

Observation 85f66a4f-aa3b-4e19-a567-13069e5ccb7d · outbound

This paper cites Qwen2.5 Technical Report.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Qwen2.5 Technical Report

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.270844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.270844Z digest=sha256:3a6f1e10d29ec82abf2c13cd09831b742b2eaa1dca42f4bcef598381b70913d9

Observation dcad6095-135b-4efc-87cd-ba66181bb4aa · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.274650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.274650Z digest=sha256:56faaa3e8020792c328b90bc4d8a9cc2cc37f66915c73fb0343723e9bf0c86fd

Observation 58f20d5d-1fcf-4a96-b5e5-37bfa9edeb1a · outbound

This paper cites Accelerating Large Language Model Decoding with Speculative Sampling.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Accelerating Large Language Model Decoding with Speculative Sampling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.278421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.278421Z digest=sha256:6fa834def09ded71543dd6cde28556d06d1b3e63072bea5897f809d04f0e522e

Observation d0d44c84-d350-481f-a96f-059836c33170 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.282627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.282627Z digest=sha256:fdb4b97a4b8e8c80661f953f6175af239e2a7327ca9b6c01c1c30058df79a760

Observation cc52335d-66ae-48ec-9852-793794367816 · outbound

This paper cites Fast Transformer Decoding: One Write-Head is All You Need.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Fast Transformer Decoding: One Write-Head is All You Need

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.286507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.286507Z digest=sha256:e12e04a48122f83d18491c5cc4fbf882cf0c8ec4dd9920163b21b2ccc30b41bd

Observation 269daa92-ecca-401d-9b8c-7f3ab60f3e19 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.291069Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.291069Z digest=sha256:0e8149f21a519a7226f86aa555f16bf701095d8591546d5600a95d348ab1ed6c

Observation e90decea-93a0-450f-92de-c7c09d3ec2f9 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.294613Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.294613Z digest=sha256:3a9fcee9f8e12d2d29dbb1427eb15845a7d2fd662db4063e159a1d169314362a

Observation 6edad205-356a-4f9b-823e-2bc6a5ea71cc · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.298239Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.298239Z digest=sha256:e9a56b98ec08fec986ac742152176e5ca510049c34eaf51a476b26d7b37e0681

Observation 5e4181d1-05e3-476a-9459-c8495ce10012 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.301769Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.301769Z digest=sha256:0d2efdc1ff68e7e56b9691b68edf863214752e6025aa9cea4bd49e15b11b0190

Observation e31308b7-64c8-4cf0-813a-f2be4ad5523c · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.305564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.305564Z digest=sha256:2b9c47b1b10f0fe71d8421db145f530c9039becf849f597d9db4508451b662ce

Observation 4c852c2a-63c3-4e5f-a077-7ffccd88ea75 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.309209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.309209Z digest=sha256:80438062b7873089f9604375dd065e031b87241007e1cd530650774122e8bf2d

Observation b17f8006-8d23-4ff8-abf5-8c441c6c2a92 · outbound

This paper cites 2026.SpeContext:Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch 2026.SpeContext:Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.313322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.313322Z digest=sha256:2724756d0f91929ae92157ea9e5471570a08e16311eaf5554cde1e7f1565e06b

Observation c202f01d-ffa8-44ac-be14-31cc044adcde · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.317118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.317118Z digest=sha256:5ae728f7472e7ea183cdc9fee843f363280f8d6975a6eb077d7e960b16777723

Observation e32c5e24-579e-4c09-af90-242c64cbed12 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.320698Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.320698Z digest=sha256:23bd0080c11101a6367c2a0c76d607255c66fe910fff48f7a60047c81ce92cce

Observation 63b37f6c-fe01-46b1-8791-52e31648eb5f · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 37

Resolution
malformed identifier
no resolver link, observed 2026-08-01T15:06:54.324420Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.324420Z digest=sha256:499ec5370786c502bb67e41071deb7d8801e3646ff1afd9b163ee05c84ea1714

Observation 56d8e877-0643-41ce-b2dd-c6820612372d · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.328130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.328130Z digest=sha256:26383fee6c93d5b43423f0f31d91d774d2f0c989e329e5c0cf66d6e47b7c53d5

Observation 47f875e5-b963-4b55-b0fe-01d743783f1e · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.332025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.332025Z digest=sha256:d2a0f2cc06903a00876ab2317461af4e9f9edfae46fb42b97e83b702cf84ca46

Observation 25dcbd49-b8cc-43c3-b0d0-4ae08f66900d · outbound

This paper cites Barrett, Zhangyang Wang, and Beidi Chen.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Barrett, Zhangyang Wang, and Beidi Chen

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.335715Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.335715Z digest=sha256:9ccdbc5030c417f5fbf1151644a8d0d04c7e549b5f454f3493d09104471b907b

Observation 856fe18b-3dc1-44a3-bc39-d3e7fc27f804 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.339854Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.339854Z digest=sha256:de4bc5b05338f89b14dfdfac049df311bc8e13372bd7244a55a2f5f7290a621f

Observation ee8b9ccc-c701-4315-8646-a4c81e53dcc3 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.344008Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.344008Z digest=sha256:6b112f5668465d67af62a146175a23f3544bdde2a1dd1399d4c3a92a46b27c51

Observation 02836f98-6a69-4f83-ab3f-17d8e6771212 · outbound

This paper cites InProceedings of the 29th ACM Symposium on Operating Systems Principles (SOSP).

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch InProceedings of the 29th ACM Symposium on Operating Systems Principles (SOSP)

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.235148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.235148Z digest=sha256:30a7c5bf62540bf1f394d86c947caf3e2eea01980381345aee104ce02bf39011

Observation 07b5298d-e673-4f36-a5f4-058153f598b5 · outbound

This paper cites an unresolved cited work.

DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch Unresolved cited work

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-01T15:06:54.193881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:06:54.193881Z digest=sha256:ae2d2736267a6e67745b90c341419628abede4439c6e1fc0979b48489b69d5ad

Pith citing papers

No inbound Pith citation observations are available.