Pith. sign in

Paper Citation Record · LEDGER

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference

As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01536 v1

Coverage vector

measured 39 of 39 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:09:29.472155Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

39 of 39 outbound references displayed

  • verified exact2
  • verified fuzzy2
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9 · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference gpt-oss-120b & gpt-oss-20b Model Card

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:25.460411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:25.460411Z digest=sha256:caf8350ae237fcb84a6d843b4e86ef6ced7be4609819a75123aee4cb22efab69

Observation 8f1a3059-cf80-4e3b-a5dd-df936e485b4f · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.760777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:25.540124Z digest=sha256:340aeba35645dafa3f378963aeabf78bfba2a3e629ad592996398862bb8c9c87

Observation 5b9af056-542b-4898-8531-8d25c89600bd · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.606557Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:25.640712Z digest=sha256:103429e95b46697b7f5ac4190883ae8baa529898e45bb6a58902708362e35228

Observation 09b0186b-9fc7-44c1-aead-cb42939868b5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.461160Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:25.737432Z digest=sha256:422499becf6bd3d6b1ca4f70421510203fda36e5e52df07b8f6ea31ee49dbbbb

Observation 518db606-ea8a-4666-8701-56654afd26c4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.295839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:25.909781Z digest=sha256:8e83e9f1eb8881740930f9028a77a7f8fef9f6f3a6b52d55229fca8f60e864a2

Observation d65fed49-ec24-48af-84c5-39d63de3fb21 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.165013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.072768Z digest=sha256:f4eebb56ed50aaf046f56867079104e4e8fffcac9892a2fc899ec68841c980b2

Observation e25114ec-a5b2-4a74-ad0f-85b41d3a8b20 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.039474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.194168Z digest=sha256:cdd7a1044333a5ccefd3aae1a92e37793eb46c74acdce6810dbaa6723100c376

Observation ccfd753a-087b-424f-a08b-896e51baa068 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.883572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.339314Z digest=sha256:3687b01a2d476991f258d16e8285e7e75644803c1c84cf672209b4ec7dd3f002

Observation c52859f4-982f-485a-bb3b-f369db80bb69 · outbound

This paper cites Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:26.458557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:26.458557Z digest=sha256:7fefa6a04f45afe860ce71d4ee69d635f6f4b0d1e55cccffd4a0bffae7f464c5

Observation 9f59e3ce-de8e-4108-b978-484db1da7ba5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.722674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.585936Z digest=sha256:78de1b8f8702ed94c8e28924cad46bc4709838b6180d1560a9cff5e5d7bf3f80

Observation 06f33b93-039a-4106-9332-64b8cd866179 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.581372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.683328Z digest=sha256:bf6abda6ea178cba5c96fbfe7d5158aac2d7c68abfd818247b24797f7da25a37

Observation fdedfe60-b2dd-4111-90df-59fe0da63113 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.428784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.812192Z digest=sha256:da4161392070320edcc75b89bbdd055e60f1705110cbdb12a156262fdc8e62c7

Observation b4f060c8-5bf0-4d6a-b40b-794450d253fa · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.281959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:26.909656Z digest=sha256:d107dcff5efaacbc9591a88f726647b2935cb18d81a32848c682a021abb726b4

Observation 63e97ef6-1f2f-4019-ae54-73e2ebc2ea63 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.142263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.018368Z digest=sha256:08fadb6e96ee20857eb5eb76484b6de949058ce0b79277316d040cf1d24dff73

Observation 991a5dba-6ec8-4ac7-bb73-f7138907e9db · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.971883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.134374Z digest=sha256:79ccbb832cd6e7f051282b2aa3713df8aa4d3554cf549d9d1f810cf981dd98a6

Observation 998bed04-e576-46d0-b9bf-15059eb36691 · outbound

This paper cites Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.255209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.255209Z digest=sha256:89bc5ef39697a8b7475d285428a9d29e352c4d648cb2f2dbbe31a61af621c9de

Observation 8fe30705-e9bb-422d-b783-48e16e03a83e · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.815385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.364607Z digest=sha256:fde6a4fa687b563073bcf49e09d4cb1fc1fbcd38d4948c95ac3092dcfa5f8302

Observation cc621830-3a20-4bb0-a2fb-9da4d1339508 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.657437Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.439093Z digest=sha256:25d49295a920043db0c47e618a20ef178285a564ea5a6730263389eb83b46fa5

Observation 1f8abdde-f27d-41dd-a902-9cb095c5daa6 · outbound

This paper cites 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:32.498383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.539068Z digest=sha256:be89cd97978d127ea941ed7230bdfabd2ad431dc7f9003c436c9c5d3bf409b92

Observation bcaf8b32-8100-45c5-bc31-4c8ac214b4a4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.631155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.631155Z digest=sha256:f0b01992fb1657ba8470487458a07105535e37651183181d9b196462b6b2a8f2

Observation abaf76ac-d623-4d99-b48a-121c41e5317b · outbound

This paper cites ShortGPT: Layers in Large Language Models are More Redundant Than You Expect.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference ShortGPT: Layers in Large Language Models are More Redundant Than You Expect

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.751477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.751477Z digest=sha256:bdb7806df2d2eb5b04b19abda829511a9e5d0e99783e515c4ed6b6eed92c4c23

Observation cce07656-58c6-4f4a-94b4-7599c754c919 · outbound

This paper cites Pointer Sentinel Mixture Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Pointer Sentinel Mixture Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.834304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.834304Z digest=sha256:3b71a3bd12f76339e1536843a9784efc8be9917fd10848219f99c50c7a33a016

Observation eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.307534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:27.958092Z digest=sha256:f237e2b4321e7075663f52bfe2ae07a5cf85edc4243e75bf4ca7df083abb22b8

Observation 7b57217b-de99-48c6-95ef-dd8d91f693eb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.153451Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.035913Z digest=sha256:8486f2bbe43f62e2ad563f57af6a5cc9dfc1a3447d025a65832d78e0cf6f1417

Observation cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40 · outbound

This paper cites 2SSP: A Two-Stage Framework for Structured Pruning of LLMs.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2SSP: A Two-Stage Framework for Structured Pruning of LLMs

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:09:29.908872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.186603Z digest=sha256:e54e668122d50aa68b7106c55187dfbd8c224461b8c2f6fc85610e3adb74501a

Observation 85c156e0-f35f-4210-afeb-5bb1e6942a17 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.010398Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.268501Z digest=sha256:091927e0fddd785ec9721bfd3b3c4a59a9c2f9934d50d14e6064f418772183ee

Observation 09a9ac09-0d70-45ad-b359-09e4075cff59 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.775108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.349277Z digest=sha256:36e61b2c4f44d53edc00d39ce194316fbbc26b4342da420e930dd96dfd59a8f0

Observation 9b2922f6-7837-4f7c-a652-b5696f317df0 · outbound

This paper cites A Simple and Effective Pruning Approach for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference A Simple and Effective Pruning Approach for Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.408073Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.408073Z digest=sha256:03b103a50511b807515b1cf08fa18ad2deea9f416a87d515fd24f8dff62c7a64

Observation 22a12d2b-b491-4ef7-b66e-b0fe35ab357d · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference LLaMA: Open and Efficient Foundation Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.494137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.494137Z digest=sha256:697eee9bcb5f0a3fda48a3925da2e420dc2ea68110a075e763c7e07e774e4949

Observation 3a455e09-76e5-4004-bc0d-48311b2ed5a9 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.484732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.609596Z digest=sha256:e2ac786aa4b7dfa6d4863f5397bdd1e22245983220203c1472c16487bf07ca34

Observation 3b184a85-9f3c-4509-a578-95e4ef8985b9 · outbound

This paper cites Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.755271Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.755271Z digest=sha256:5958e6a3b4b4a93b584a908e2f38f0bb302e558191e3266c4fa80d1d296e0603

Observation c4ea8b7f-a3e3-4bd3-8c41-673785a545bb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.230643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.832699Z digest=sha256:6e86b9b762921440514fbdceebe19baa8d34b0405c16a17a7849822d67cc59e6

Observation 4964a459-efbc-4f63-bd09-d2701ab4a430 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.941108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:28.938982Z digest=sha256:af58abdb07fd63ca583f1602ebf9ca0f55d72b14a1463a1ea4271efee5274c25

Observation e36c7279-bba0-4acd-9992-3dc374a73064 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 34

Resolution
verified exact
raw_fallback, observed 2026-08-06T00:09:29.728433Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:29.058718Z digest=sha256:770323b0c031bfa2c329248d38b60bb75d07389bf344d9fecda9e4a9d37b2706

Observation 0d67357a-368f-4125-8633-4370b11fa352 · outbound

This paper cites OPT: Open Pre-trained Transformer Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference OPT: Open Pre-trained Transformer Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.156883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.156883Z digest=sha256:b577b07630b5d986778576bf2240068ded2c40c30bf9aec9e671fb5637bc68d5

Observation ec737639-aee7-439a-956b-5bd8d9519247 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.629179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:29.267647Z digest=sha256:c22808bc1a7a6657d52a76e1223186a87d2b0ae9ef50c55c89c1b478ce9b73af

Observation 3d213abd-06ad-48ac-9938-5a333520d90d · outbound

This paper cites 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:30.382427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:29.336047Z digest=sha256:e0d3c810d0abcd21d00c1da619f2d15e815c8c5d7ebab256346db94c51b2a4d0

Observation eae9f883-b582-45c3-a052-d1e00201dc5e · outbound

This paper cites BlockPruner: Fine-grained Pruning for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference BlockPruner: Fine-grained Pruning for Large Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.407949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.407949Z digest=sha256:12c82a58edc2f0ce04a479cf3fcf18dd4f2b2c58750ae8f7a0177c93a529c5b2

Observation 3c91bb2c-fc32-4948-848c-964556848b74 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.230893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-06T00:09:29.472155Z digest=sha256:a982eedbbbce3a1c4793b0029c8af72dd6388db36e2e6e84918e70c7622e8717

Pith citing papers

No inbound Pith citation observations are available.