Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-07-13T07:32:31.866525Z
Paper Citation Record · LEDGER
As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.08786.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-07-13T07:32:31.866525Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
36 of 36 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation d0cf5530-4100-403f-bd8c-2b131fc5cd17 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 039d512b-42fc-4446-817b-9e2370ce73dc · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Generating Long Sequences with Sparse Transformers
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5fd17147-2199-44de-8f7e-84a5925b2ad3 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cd4f4e3c-6cc1-47cb-975e-34bd23595af7 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation cb61c7cd-d7dd-430d-892e-b9c55b6130be · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 47b9df60-e9fe-47bc-874e-fe0027c757b4 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ddd8af86-96da-48c2-b56d-eb3091028c81 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 105be52d-c7df-4a21-bf80-156c38594128 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 03d2457e-03a1-43b7-a64b-8607a4754edf · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 429f24c8-b477-4ee0-9925-715fc41c819a · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d7fa3c7e-523f-4d69-b8bd-73e9b7ce2917 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 633c8c4b-4aa6-4e06-b7f7-cdc386e3999d · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8da298ec-cafa-4b43-a64e-999b194a603b · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 88f6543f-573f-4729-ac8c-e9ecfcf5157b · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 73ab3e9f-866c-40ec-8401-97cc9dedcce7 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6d0ddaef-192f-4af9-846f-78a5c166523c · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e68baf3f-8c0a-405c-baf1-c58c66589486 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8bca3f89-e262-4dcb-96a1-d62d44d93393 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3d2ea893-bfed-4c7c-bdea-84039af51db9 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7d453311-f192-4ef9-9781-13d8ec68cf52 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0c09906e-8bab-425d-844e-db84854ae697 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b59cdd9-19b7-47f6-8081-9d22bad278bc · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1e151427-95a8-43be-89c9-a9d59594437f · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2f6ad3a4-c991-4d54-9e5d-9ccff413a265 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3b8a06cf-6af1-4d1e-af6e-8862197fba1c · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9a489717-3b7b-432e-a2aa-846535eea616 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices 2003.Iterative methods for sparse linear systems
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a7abd195-2299-48a0-8b27-8be80e8719b5 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c83ceaa4-8714-4451-a2de-b9851f08b948 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f4943a2c-731b-4ffb-8164-9f435bdef137 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0713b070-d974-4911-947a-046cb589503b · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8e0b6b09-347b-40c1-a311-5ddc4e06f5ca · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bb77f60e-7d70-4d34-b372-28e313bede74 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dca45bac-1ef7-4c2c-9d69-2917dad3d82a · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation aa2b316e-cab6-4296-b549-125f4995cbfa · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices OPT: Open Pre-trained Transformer Language Models
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 05c1cd9e-56e3-4be0-a3e7-2cc85682a38d · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c592ae79-9896-4d9c-aa21-6489a6679045 · outbound
Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices Unresolved cited work
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.